Flux 3 AI 视频与图像模型

Flux 3 AI 视频与图像模型

Flux 3 是 Black Forest Labs 面向视频、图像、原生音频与动作预测的多模态模型。了解已确认的 Flux 3 功能与抢先体验计划。

  • 原生视频与同步音频: Flux 3 可在一次生成中创建多样视频与原生音频,抢先体验阶段最长可达 20 秒。Black Forest Labs 强调语音、音效与物理事件的同步,但目前公布的评估仍属初步结果。
  • 多模态输入与参考: Flux 3 支持文本生成视频、图像生成视频、视频生成视频,以及视音频续写。图像可作为起始帧或视觉参考,参考视频则可将角色或核心元素延续到新场景。
  • 关键帧、长序列与动态文字: Flux 3 支持关键帧转视频、多语言对话、动态文字、多种画面比例,以及智能串联多个片段。Black Forest Labs 表示,视觉参考有助于跨镜头保持角色一致,但目前独立测试仍然有限。
  • 超越视频的单一基础模型: Flux 3 也计划通过同一多模态基础模型进行图像生成、编辑与动作预测。图像抢先体验预计在视频预览后开放,动作能力则先提供给 mimic robotics 等特定研究与商业伙伴。
  • 规划中的开放权重多模态模型: Flux 3 Dev 规划为支持视频、音频、图像与动作预测的开放权重基础模型。Black Forest Labs 尚未公布发布日期、许可、模型大小、硬件需求、API 定价或最终正式版评测。
  • 定义场景与参考素材: 先明确主体、环境、动作、镜头运动、时长、画面比例、对白和声音。如当前 Flux 3 访问权限支持参考输入,可加入起始图、关键帧或参考视频,并明确需要保持一致的细节。
Black Forest Labs 多模态模型

Flux 3 AI 视频与图像模型

Flux 3 是 Black Forest Labs 面向视频、图像、原生音频与动作预测的多模态模型。了解已确认的 Flux 3 功能与抢先体验计划。

探索 AI 视频

Flux 3 官方视频展示

观看 Black Forest Labs 于 2026 年 7 月 23 日发布的四组首发样片。这些 Flux 3 官方视频分别展示海岸风暴、第一人称赛道运动、镜面舞蹈场景和温暖的黏土动画。

Flux 3 海洋动力学

Flux 3 官方首发样片:展示海浪、飞沫与海鸟在风暴海岸中的复杂运动。

Flux 3 第一人称运动

Flux 3 官方首发样片:摩托车驶过雨中赛道,画面包含高速运镜、湿润路面和赛道护栏。

镜面、水景与舞蹈

Flux 3 官方首发样片:展示镜面建筑、水面、烛光与多层反射中的舞厅舞蹈。

Flux 3 风格化角色动画

Flux 3 官方首发样片:以温暖的黏土动画、可触感材质和角色导向的物理运动构建场景。

Flux 3 有何不同

01 / 视频 • 音频

原生视频与同步音频

Flux 3 可在一次生成中创建多样视频与原生音频,抢先体验阶段最长可达 20 秒。Black Forest Labs 强调语音、音效与物理事件的同步,但目前公布的评估仍属初步结果。

02 / 文字 • 图像 • 视频

多模态输入与参考

Flux 3 支持文本生成视频、图像生成视频、视频生成视频,以及视音频续写。图像可作为起始帧或视觉参考,参考视频则可将角色或核心元素延续到新场景。

03 / 控制 • 连续性

关键帧、长序列与动态文字

Flux 3 支持关键帧转视频、多语言对话、动态文字、多种画面比例,以及智能串联多个片段。Black Forest Labs 表示,视觉参考有助于跨镜头保持角色一致,但目前独立测试仍然有限。

04 / 图像 • 动作

超越视频的单一基础模型

Flux 3 也计划通过同一多模态基础模型进行图像生成、编辑与动作预测。图像抢先体验预计在视频预览后开放,动作能力则先提供给 mimic robotics 等特定研究与商业伙伴。

05 / Dev • 开放权重

规划中的开放权重多模态模型

Flux 3 Dev 规划为支持视频、音频、图像与动作预测的开放权重基础模型。Black Forest Labs 尚未公布发布日期、许可、模型大小、硬件需求、API 定价或最终正式版评测。

Flux 3 在视频制作流程中的应用方式

以下流程基于 Black Forest Labs 已公布的能力,仅面向获准参与抢先体验的用户。Flux 3 在全面开放前,其功能、接口与使用条款仍可能调整。

定义场景与参考素材

先明确主体、环境、动作、镜头运动、时长、画面比例、对白和声音。如当前 Flux 3 访问权限支持参考输入,可加入起始图、关键帧或参考视频,并明确需要保持一致的细节。

生成并评估核心镜头

使用 Flux 3 生成核心镜头后,检查人体结构、物体一致性、口型同步、音频时序、物理运动、动态文字和镜头连续性。每次只调整一个变量,避免在每次预览后重写整段提示词。

延展、串联并完成

Black Forest Labs 表示,视觉参考与关键帧可帮助将多个片段串联为更长的多镜头序列。生产用途和公开分享仍须遵守适用的 Flux 3 访问条款并获得相应许可。

Flux 3 常见问题

Flux 3 尚在逐步开放,先探索 AI 视频创作

探索 AI 视频