Code & Chain · Signal Desk

FLUX 3 發布:Black Forest Labs 以單一模型進軍影像、音訊與機器人動作生成

原始來源Tech Times

摘要

Black Forest Labs 於 2026 年 7 月 23 日發表 FLUX 3,為統一多模態模型,可生成 20 秒帶同步音訊的影片、編輯圖像及預測機器人動作。FLUX 3 Video 提供文本轉影片、影像轉影片等功能,FLUX 3 Action 則與機器人合作夥伴進行早期測試,FLUX 3 Image 尚未發布。開放權重版本 FLUX 3 Dev 計畫於 2026 年稍晚公開,將成為首個能聯合生成影片、音訊和圖像的開源多模態骨幹。

重點整理

  • 開發者和研究人員未來可利用 FLUX 3 Dev 在本地端訓練和微調多模態模型,推動影片、音訊和機器人領域的開放創新
  • 開發者可期待首個開放多模態生成模型,用於影像、音訊和機器人研究與應用

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。