原始來源Tech Times
摘要
Black Forest Labs 於 2026 年 7 月 23 日發表 FLUX 3,為統一多模態模型,可生成 20 秒帶同步音訊的影片、編輯圖像及預測機器人動作。FLUX 3 Video 提供文本轉影片、影像轉影片等功能,FLUX 3 Action 則與機器人合作夥伴進行早期測試,FLUX 3 Image 尚未發布。開放權重版本 FLUX 3 Dev 計畫於 2026 年稍晚公開,將成為首個能聯合生成影片、音訊和圖像的開源多模態骨幹。
重點整理
- 開發者和研究人員未來可利用 FLUX 3 Dev 在本地端訓練和微調多模態模型,推動影片、音訊和機器人領域的開放創新
- 開發者可期待首個開放多模態生成模型,用於影像、音訊和機器人研究與應用
編輯說明
本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。