Black Forest Labs 發布 FLUX 3:首款影片模型驅動機器人技術,與奧迪建立合作夥伴關係
重點速覽
- •FLUX 3 是 Black Forest Labs 首款能夠生成長達 20 秒影片片段的模型,配備包含對話、音效和環境噪音的同步音訊。
- •在偏好測試中,人類評審在 77% 的比較中偏好 FLUX 3 勝過 Runway Gen-4.5,在 93% 的比較中勝過 Luma Ray 3.2,但評估並未包含 OpenAI 的 Sora 或 Google 的 Veo。
- •FLUX 3 底層的相同多模態架構驅動了 FLUX-mimic,這是一套由 mimic robotics 共同開發的機器人模型,奧迪正在其生產線上測試,用於安裝柔性車門密封條等任務。
- •FLUX-mimic 達到約 101 毫秒的系統反應時間,BFL 稱其與人類視覺反射相當。
- •FLUX 3 的開源權重 Dev 版本是唯一計劃用於本地部署的版本,預計要到 2026 年稍晚才會推出,而影片和動作功能目前僅限於 API 和特定合作夥伴管道使用。

Black Forest Labs 已發布 FLUX 3 早期體驗版,標誌著該公司首款能夠生成影片而不僅限於靜態影像的模型。新系統可產生長達 20 秒並附有同步音訊的片段,建構於同時訓練影像、影片和聲音的多模態架構之上。此次推出使 BFL 進入 AI 領域競爭最激烈的類別之一,其中 OpenAI 的 Sora、Google 的 Veo、Runway 和 Luma 都在競相打造可商業化的 AI 生成影片。
相同的底層技術也驅動 FLUX-mimic,這是一套與總部位於蘇黎世的 mimic robotics 合作開發的機器人模型,德國汽車製造商奧迪已在其生產線上進行測試。開源權重的「Dev」版本——唯一計劃用於本地部署的版本——預計要到 2026 年稍晚才會推出。影片和動作功能目前僅能透過 API 和特定合作夥伴管道使用,根據 BFL 表示,影像生成功能將在「未來幾週內」跟進。
FLUX 3 的影片功能是其旗艦特色。該模型生成的片段配有與螢幕畫面同步的音訊,包括對話、音效和環境噪音。在早期正面對決評估中,人類評審在 77% 的比較中偏好 FLUX 3 的輸出結果勝過 Runway Gen-4.5,在 93% 的比較中勝過 Luma Ray 3.2。該模型也略微超越 Gemini Omni 和 Seedance,在 52% 的評估中勝出。BFL 指出這些結果反映的是偏好測試,而非固定評分標準——評審觀看成對片段並選擇較具說服力者,BFL 則統計 FLUX 3 勝出的頻率。值得注意的是,這些評估並未包含與 OpenAI 的 Sora 或 Google 的 Veo 的直接比較,使得 FLUX 3 在 BFL 公布的結果中與這些知名系統的相對地位未經測試。
該模型同時保持了與 FLUX 系列傳統一致的強大靜態影像能力。BFL 分享了示範影像,展現了超越擬真攝影的廣泛多樣風格。
BFL 將 FLUX 3 定位為不僅僅是創意內容工具。「一個只學習影像的模型只能生成影像,」共同創辦人兼執行長 Robin Rombach 表示。該公司的論點認為,學習預測影片意味著同時學習其底層物理學——重量、接觸、時機——而這正是一台機器在物理世界中移動所需要的。使用大規模生成模型作為機器人控制基礎的想法,在 AI 和機器人領域引起了日益增長的關注,包括 Google DeepMind 和 Tesla 在內的公司也在探索相關方法。
這一論點構成了 FLUX-mimic 的基礎。由 mimic robotics 開發,該系統在 FLUX 3 的影片預測引擎上加入了一個輕量級的「解碼器」,將模型對運動的內部理解轉化為實際的機器人動作。奧迪已在安裝柔性車門密封條等任務上測試該系統——這是傳統自動化長期以來難以處理的工作,因為可變形材料的行為難以預測,且抗拒傳統機器人所依賴的剛性程式設計。
「奧迪代表了我們為 FLUX-mimic 打造的那種製造業合作夥伴,」mimic robotics 共同創辦人 Stephan-Daniel Gravert 表示。奧迪的 Christoph Schneider 表示,這些機器人現在能「解決複雜的軟體操控作業」,這是早期機器人無法做到的。BFL 報告指出,完整系統的反應時間約為 101 毫秒,與人類視覺反射相當。
FLUX 3 的推出是 BFL 重奪動能的最新嘗試。公司於 2024 年 8 月由曾協助在 Stability AI 打造原始 Stable Diffusion 模型的研究人員創立,Black Forest Labs 迅速將 FLUX 系列確立為主導力量。其開源的 Flux Dev 和 Schnell 模型獲得了最佳開源影像生成器的稱號,超越了 MidJourney,也勝過 Stability AI 自家的 Stable Diffusion 3。FLUX 1.1 Pro 隨後在 10 月登上 Artificial Analysis 影像競技場榜首,不過該版本並非開源。
BFL 於 2025 年 11 月發布了 FLUX.2,但未能達到同樣的人氣。原始 Flux 模型持有的開源桂冠一直持續到 2025 年底,阿里巴巴的 Z-Image Turbo 在低端消費級顯示卡上達到了相同的品質。「這才是 SD3 應該有的樣子,」一位 CivitAI 用戶當時評論道。
FLUX 3 代表了 BFL 的回歸,但目前尚未完全開源。影片和動作功能現已透過 API 和特定合作夥伴(包括 mimic robotics)在早期體驗中提供。影像生成將在未來幾週內跟進。開源權重的 Dev 版本預計於 2026 年稍晚推出。