Flux 3 AI 影片與圖像模型

Flux 3 AI 影片與圖像模型

Flux 3 是 Black Forest Labs 面向影片、圖像、原生音訊與動作預測的多模態模型。了解已確認的 Flux 3 功能與搶先體驗計畫。

  • 原生影片與同步音訊: Flux 3 可在一次生成中建立多樣影片與原生音訊,搶先體驗階段最長可達 20 秒。Black Forest Labs 強調語音、音效與物理事件的同步,但目前公布的評估仍屬初步結果。
  • 多模態輸入與參考: Flux 3 支援文字生成影片、圖像生成影片、影片生成影片,以及視音訊續寫。圖像可作為起始影格或視覺參考,參考影片則可將角色或核心元素延續到新場景。
  • 關鍵影格、長序列與動態文字: Flux 3 支援關鍵影格轉影片、多語言對話、動態文字、多種畫面比例,以及智慧串聯多個片段。Black Forest Labs 表示,視覺參考有助於跨鏡頭維持角色一致,但目前獨立測試仍然有限。
  • 超越影片的單一基礎模型: Flux 3 也計畫透過同一多模態基礎模型進行圖像生成、編輯與動作預測。圖像搶先體驗預計在影片預覽後開放,動作能力則先提供給 mimic robotics 等特定研究與商業夥伴。
  • 規劃中的開放權重多模態模型: Flux 3 Dev 規劃為支援影片、音訊、圖像與動作預測的開放權重基礎模型。Black Forest Labs 尚未公布發布日期、授權、模型大小、硬體需求、API 定價或最終正式版評測。
  • 定義場景與參考素材: 先明確主體、環境、動作、鏡頭運動、時長、畫面比例、對白與聲音。如目前的 Flux 3 存取權限支援參考輸入,可加入起始圖像、關鍵影格或參考影片,並明確指出需要維持一致的細節。
Black Forest Labs 多模態模型

Flux 3 AI 影片與圖像模型

Flux 3 是 Black Forest Labs 面向影片、圖像、原生音訊與動作預測的多模態模型。了解已確認的 Flux 3 功能與搶先體驗計畫。

探索 AI 影片

Flux 3 官方影片展示

觀看 Black Forest Labs 於 2026 年 7 月 23 日發布的四組首發樣片。這些 Flux 3 官方影片分別展示海岸風暴、第一人稱賽道運動、鏡面舞蹈場景與溫暖的黏土動畫。

Flux 3 海洋動力學

Flux 3 官方首發樣片:展示海浪、飛沫與海鳥在風暴海岸中的複雜運動。

Flux 3 第一人稱運動

Flux 3 官方首發樣片:摩托車駛過雨中賽道,畫面包含高速運鏡、濕潤路面與賽道護欄。

鏡面、水景與舞蹈

Flux 3 官方首發樣片:展示鏡面建築、水面、燭光與多層反射中的舞廳舞蹈。

Flux 3 風格化角色動畫

Flux 3 官方首發樣片:以溫暖的黏土動畫、可觸感材質和角色導向的物理運動建構場景。

Flux 3 有何不同

01 / 影片 • 音訊

原生影片與同步音訊

Flux 3 可在一次生成中建立多樣影片與原生音訊,搶先體驗階段最長可達 20 秒。Black Forest Labs 強調語音、音效與物理事件的同步,但目前公布的評估仍屬初步結果。

02 / 文字 • 圖像 • 影片

多模態輸入與參考

Flux 3 支援文字生成影片、圖像生成影片、影片生成影片,以及視音訊續寫。圖像可作為起始影格或視覺參考,參考影片則可將角色或核心元素延續到新場景。

03 / 控制 • 連續性

關鍵影格、長序列與動態文字

Flux 3 支援關鍵影格轉影片、多語言對話、動態文字、多種畫面比例,以及智慧串聯多個片段。Black Forest Labs 表示,視覺參考有助於跨鏡頭維持角色一致,但目前獨立測試仍然有限。

04 / 圖像 • 動作

超越影片的單一基礎模型

Flux 3 也計畫透過同一多模態基礎模型進行圖像生成、編輯與動作預測。圖像搶先體驗預計在影片預覽後開放,動作能力則先提供給 mimic robotics 等特定研究與商業夥伴。

05 / Dev • 開放權重

規劃中的開放權重多模態模型

Flux 3 Dev 規劃為支援影片、音訊、圖像與動作預測的開放權重基礎模型。Black Forest Labs 尚未公布發布日期、授權、模型大小、硬體需求、API 定價或最終正式版評測。

Flux 3 在影片製作流程中的應用方式

以下流程依據 Black Forest Labs 已公布的能力,僅供獲准參與搶先體驗的使用者參考。Flux 3 在全面開放前,其功能、介面與使用條款仍可能調整。

定義場景與參考素材

先明確主體、環境、動作、鏡頭運動、時長、畫面比例、對白與聲音。如目前的 Flux 3 存取權限支援參考輸入,可加入起始圖像、關鍵影格或參考影片,並明確指出需要維持一致的細節。

生成並評估核心鏡頭

使用 Flux 3 生成核心鏡頭後,檢查人體結構、物件一致性、嘴型同步、音訊時序、物理動態、動態文字與鏡頭連續性。每次只調整一個變數,避免在每次預覽後重寫整段提示詞。

延伸、串接並完成

Black Forest Labs 表示,視覺參考與關鍵影格可協助將多個片段串聯為更長的多鏡頭序列。生產用途與公開分享仍須遵守適用的 Flux 3 存取條款並取得相應許可。

Flux 3 常見問題

Flux 3 尚在逐步開放,先探索 AI 影片創作

探索 AI 影片