Flux 3 AI動画・画像モデル

Flux 3 AI動画・画像モデル

Flux 3は、動画、画像、ネイティブ音声、行動予測に対応するBlack Forest Labsのマルチモーダルモデルです。確認済みのFlux 3機能と早期アクセス計画を紹介します。

  • 同期音声付きのネイティブ動画: Flux 3は、早期アクセスでは最大20秒の多彩な動画とネイティブ音声を一度に生成できます。Black Forest Labsは発話、効果音、物理イベントの同期を強調していますが、公開評価はまだ予備的なものです。
  • マルチモーダル入力と参照: Flux 3はテキストから動画、画像から動画、動画から動画、動画と音声の続きを生成できます。画像は開始フレームや視覚参照として使え、元動画の人物や中心要素を新しいシーンへ引き継げます。
  • キーフレーム、長いシーケンス、文字表現: Flux 3はキーフレーム間の動画化、多言語会話、動く文字表現、さまざまなアスペクト比、クリップのエージェント連結に対応します。視覚参照で複数ショットの人物を保てるとされていますが、独立した検証はまだ限られています。
  • 動画を超える単一バックボーン: Flux 3は同じマルチモーダル基盤で、画像生成・編集と行動予測も目指します。画像の早期アクセスは動画プレビュー後に予定され、行動機能はmimic roboticsなど選定された研究・商用パートナーから始まります。
  • 提供予定のオープンウェイトモデル: Flux 3 Devは、動画、音声、画像、行動予測向けのオープンウェイト基盤として計画されています。Black Forest Labsは公開日、ライセンス、モデル規模、必要ハードウェア、API料金、最終ベンチマークをまだ公表していません。
  • シーンと参照素材を定義する: 被写体、環境、アクション、カメラワーク、長さ、アスペクト比、台詞、サウンドを整理します。Flux 3 のアクセス環境で参照入力が利用できる場合は、開始画像、キーフレーム、元動画を追加し、維持すべき要素を明示します。
Black Forest Labsのマルチモーダルモデル

Flux 3 AI動画・画像モデル

Flux 3は、動画、画像、ネイティブ音声、行動予測に対応するBlack Forest Labsのマルチモーダルモデルです。確認済みのFlux 3機能と早期アクセス計画を紹介します。

AI動画を試す

Flux 3 公式動画ショーケース

Black Forest Labs が2026年7月23日に公開した4つのローンチサンプルをご覧ください。Flux 3 の公式映像では、沿岸の天候、主観視点のレース、鏡に囲まれたダンスシーン、温かみのあるクレイアニメーションを確認できます。

Flux 3 海洋ダイナミクス

嵐による波、しぶき、海鳥が海岸沿いに動く Flux 3 の公式ローンチサンプルです。

Flux 3 一人称モーション

雨に濡れたサーキットを走るバイクを、高速なカメラワーク、濡れた路面、コース脇のバリアとともに描いた Flux 3 の公式ローンチサンプルです。

鏡、水、ダンス

鏡張りの建築、水、ろうそくの光、重なり合う反射の中で社交ダンスを描いた Flux 3 の公式ローンチサンプルです。

Flux 3 スタイル化キャラクターアニメーション

Flux 3 公式ローンチ映像。温かなクレイアニメ、触感のある素材、キャラクター中心の物理運動を組み合わせています。

Flux 3の特徴

01 / 動画 • 音声

同期音声付きのネイティブ動画

Flux 3は、早期アクセスでは最大20秒の多彩な動画とネイティブ音声を一度に生成できます。Black Forest Labsは発話、効果音、物理イベントの同期を強調していますが、公開評価はまだ予備的なものです。

02 / テキスト • 画像 • 動画

マルチモーダル入力と参照

Flux 3はテキストから動画、画像から動画、動画から動画、動画と音声の続きを生成できます。画像は開始フレームや視覚参照として使え、元動画の人物や中心要素を新しいシーンへ引き継げます。

03 / 制御 • 連続性

キーフレーム、長いシーケンス、文字表現

Flux 3はキーフレーム間の動画化、多言語会話、動く文字表現、さまざまなアスペクト比、クリップのエージェント連結に対応します。視覚参照で複数ショットの人物を保てるとされていますが、独立した検証はまだ限られています。

04 / 画像 • 行動

動画を超える単一バックボーン

Flux 3は同じマルチモーダル基盤で、画像生成・編集と行動予測も目指します。画像の早期アクセスは動画プレビュー後に予定され、行動機能はmimic roboticsなど選定された研究・商用パートナーから始まります。

05 / Dev • オープンウェイト

提供予定のオープンウェイトモデル

Flux 3 Devは、動画、音声、画像、行動予測向けのオープンウェイト基盤として計画されています。Black Forest Labsは公開日、ライセンス、モデル規模、必要ハードウェア、API料金、最終ベンチマークをまだ公表していません。

動画制作ワークフローにおける Flux 3

このワークフローは Black Forest Labs が発表した機能に基づき、早期アクセスを承認されたユーザーを対象としています。正式提供前に、機能、インターフェース、利用条件が変更される場合があります。

シーンと参照素材を定義する

被写体、環境、アクション、カメラワーク、長さ、アスペクト比、台詞、サウンドを整理します。Flux 3 のアクセス環境で参照入力が利用できる場合は、開始画像、キーフレーム、元動画を追加し、維持すべき要素を明示します。

中心となるショットを生成・評価する

Flux 3 でメインショットを生成し、人体構造、オブジェクトの持続性、リップシンク、音声タイミング、物理的な動き、文字表現、カメラの連続性を確認します。プレビューごとにプロンプト全体を書き直さず、一度に一つの変数を調整します。

延長・連結して仕上げる

Black Forest Labs によると、ビジュアル参照とキーフレームを使って、複数のクリップをより長いマルチショットシーケンスにつなげられます。制作利用および一般公開には、適用される Flux 3 のアクセス条件と許可が必要です。

Flux 3のよくある質問

Flux 3の展開を待ちながらAI動画を試す

AI動画を試す