Modèle vidéo et image IA Flux 3

Modèle vidéo et image IA Flux 3

Flux 3 est le modèle multimodal de Black Forest Labs pour la vidéo, l'image, l'audio natif et la prédiction d'actions. Découvrez les fonctions confirmées de Flux 3 et son accès anticipé.

  • Vidéo native avec audio synchronisé: Flux 3 peut générer des vidéos variées avec audio natif en une seule passe, avec des clips allant jusqu'à 20 secondes pendant l'accès anticipé. Black Forest Labs met en avant la synchronisation de la parole, des effets sonores et des événements physiques, mais les évaluations publiées restent préliminaires.
  • Entrées et références multimodales: Flux 3 prend en charge le texte-vers-vidéo, l'image-vers-vidéo, la vidéo-vers-vidéo et la continuation vidéo-audio. Les images peuvent servir d'images de départ ou de références visuelles, tandis que les clips sources peuvent transporter un personnage ou un élément central dans une nouvelle scène.
  • Images clés, séquences longues et typographie: Flux 3 inclut les transitions d'images clés vers la vidéo, les dialogues multilingues, la typographie animée, différents formats et l'enchaînement agentique de clips. Black Forest Labs indique que les références visuelles peuvent préserver les personnages entre plusieurs plans, mais les tests indépendants restent limités.
  • Une base unique au-delà de la vidéo: Flux 3 vise aussi la synthèse et l'édition d'images ainsi que la prédiction d'actions à partir de la même base multimodale. L'accès anticipé à l'image est prévu après l'aperçu vidéo, tandis que l'action débute avec des partenaires de recherche et commerciaux sélectionnés comme mimic robotics.
  • Un modèle multimodal à poids ouverts prévu: Flux 3 Dev est prévu comme une base à poids ouverts pour la vidéo, l'audio, l'image et la prédiction d'actions. Black Forest Labs n'a pas encore publié de date de sortie, de licence, de taille de modèle, de configuration matérielle, de tarifs API ni de benchmarks finaux.
  • Définir la scène et les références: Commencez par le sujet, l’environnement, l’action, le mouvement de caméra, la durée, le format, les dialogues et le son. Lorsque votre accès à Flux 3 accepte les références, ajoutez une image de départ, une image clé ou un clip source, puis précisez les détails à conserver.
Modèle multimodal de Black Forest Labs

Modèle vidéo et image IA Flux 3

Flux 3 est le modèle multimodal de Black Forest Labs pour la vidéo, l'image, l'audio natif et la prédiction d'actions. Découvrez les fonctions confirmées de Flux 3 et son accès anticipé.

Explorer la vidéo IA

Galerie vidéo officielle Flux 3

Découvrez quatre extraits de lancement publiés par Black Forest Labs le 23 juillet 2026. Ces clips officiels Flux 3 montrent une météo côtière, une course en vue subjective, une danse au milieu de miroirs et une animation chaleureuse en pâte à modeler.

Dynamique océanique Flux 3

Extrait officiel Flux 3 montrant des vagues de tempête, des embruns et des oiseaux marins le long d’une côte.

Mouvement à la première personne Flux 3

Extrait officiel Flux 3 suivant une moto sur un circuit détrempé, avec des mouvements de caméra rapides, de l’asphalte mouillé et des barrières de piste.

Miroirs, eau et danse

Extrait officiel Flux 3 montrant une danse de salon parmi une architecture en miroir, de l’eau, des chandelles et des reflets superposés.

Animation de personnages stylisée Flux 3

Extrait officiel Flux 3 mêlant animation en argile chaleureuse, matériaux tactiles et mouvement physique centré sur le personnage.

Ce qui distingue Flux 3

01 / Vidéo • Audio

Vidéo native avec audio synchronisé

Flux 3 peut générer des vidéos variées avec audio natif en une seule passe, avec des clips allant jusqu'à 20 secondes pendant l'accès anticipé. Black Forest Labs met en avant la synchronisation de la parole, des effets sonores et des événements physiques, mais les évaluations publiées restent préliminaires.

02 / Texte • Image • Vidéo

Entrées et références multimodales

Flux 3 prend en charge le texte-vers-vidéo, l'image-vers-vidéo, la vidéo-vers-vidéo et la continuation vidéo-audio. Les images peuvent servir d'images de départ ou de références visuelles, tandis que les clips sources peuvent transporter un personnage ou un élément central dans une nouvelle scène.

03 / Contrôle • Continuité

Images clés, séquences longues et typographie

Flux 3 inclut les transitions d'images clés vers la vidéo, les dialogues multilingues, la typographie animée, différents formats et l'enchaînement agentique de clips. Black Forest Labs indique que les références visuelles peuvent préserver les personnages entre plusieurs plans, mais les tests indépendants restent limités.

04 / Image • Action

Une base unique au-delà de la vidéo

Flux 3 vise aussi la synthèse et l'édition d'images ainsi que la prédiction d'actions à partir de la même base multimodale. L'accès anticipé à l'image est prévu après l'aperçu vidéo, tandis que l'action débute avec des partenaires de recherche et commerciaux sélectionnés comme mimic robotics.

05 / Dev • Poids ouverts

Un modèle multimodal à poids ouverts prévu

Flux 3 Dev est prévu comme une base à poids ouverts pour la vidéo, l'audio, l'image et la prédiction d'actions. Black Forest Labs n'a pas encore publié de date de sortie, de licence, de taille de modèle, de configuration matérielle, de tarifs API ni de benchmarks finaux.

La place de Flux 3 dans un flux de production vidéo

Ce flux repose sur les fonctionnalités annoncées par Black Forest Labs et s’adresse aux utilisateurs admis à l’accès anticipé. Les fonctions, interfaces et conditions d’utilisation peuvent évoluer avant la disponibilité générale.

Définir la scène et les références

Commencez par le sujet, l’environnement, l’action, le mouvement de caméra, la durée, le format, les dialogues et le son. Lorsque votre accès à Flux 3 accepte les références, ajoutez une image de départ, une image clé ou un clip source, puis précisez les détails à conserver.

Générer et évaluer le plan principal

Utilisez Flux 3 pour créer le plan principal, puis vérifiez l’anatomie, la persistance des objets, la synchronisation labiale, le rythme audio, le mouvement physique, la typographie et la continuité de caméra. Modifiez une seule variable à la fois plutôt que de réécrire tout le prompt après chaque aperçu.

Prolonger, enchaîner et finaliser

Selon Black Forest Labs, les références visuelles et les images clés peuvent aider à enchaîner des clips en séquences plus longues de plusieurs plans. L’utilisation en production et le partage public restent soumis aux conditions et autorisations d’accès applicables à Flux 3.

Questions fréquentes sur Flux 3

Explorez la vidéo IA pendant le déploiement de Flux 3

Explorer la vidéo IA