模型 / MODELS
Black Forest Labs 推出 FLUX 3 多模態模型,單次生成 20 秒附聲影片
Black Forest Labs 以 Early Access 推出 FLUX 3 多模態基礎模型,於統一架構內聯合學習影像、影片與音訊,單次可生成最長 20 秒含原生音訊的影片,並公布對多家競品的初步人工評測勝率。
所有與「Black Forest Labs」相關的 AI Daily Mail 報導,以具名、可回查的來源為基礎,依發布時間排序。
共 2 則文章,依發布時間排序
Black Forest Labs 以 Early Access 推出 FLUX 3 多模態基礎模型,於統一架構內聯合學習影像、影片與音訊,單次可生成最長 20 秒含原生音訊的影片,並公布對多家競品的初步人工評測勝率。
FLUX 3 同時聯合訓練圖像、視訊與音訊,視訊預測占逾 95% 算力;衍生出的 FLUX-mimic 視訊動作模型已在 Audi 生產線測試並部署,backbone 推論低於 80ms。