Flux 3 AI-video- og bildemodell

Flux 3 AI-video- og bildemodell

Flux 3 er Black Forest Labs' multimodale modell for video, bilder, innebygd lyd og handlingsforutsigelse. Utforsk bekreftede Flux 3-funksjoner og planer for tidlig tilgang.

  • Innebygd video med synkronisert lyd: Flux 3 kan generere varierte videoer med innebygd lyd i én operasjon, med klipp på opptil 20 sekunder i tidlig tilgang. Black Forest Labs fremhever synkronisert tale, lydeffekter og fysiske hendelser, men publiserte evalueringer er fortsatt foreløpige.
  • Multimodale inndata og referanser: Flux 3 støtter tekst-til-video, bilde-til-video, video-til-video og fortsettelse av video og lyd. Bilder kan brukes som startbilder eller visuelle referanser, mens kildeklipp kan ta en figur eller et sentralt element inn i en ny scene.
  • Nøkkelbilder, lengre sekvenser og typografi: Flux 3 omfatter overganger fra nøkkelbilder til video, flerspråklig dialog, animert typografi, ulike bildeformater og agentisk sammenkobling av klipp. Black Forest Labs sier visuelle referanser kan bevare figurer mellom opptak, men uavhengig testing er fortsatt begrenset.
  • Én grunnmodell utover video: Flux 3 sikter også mot bildegenerering og -redigering samt handlingsforutsigelse fra samme multimodale grunnmodell. Tidlig bildetilgang planlegges etter videoforhåndsvisningen, mens handling starter med utvalgte partnere som mimic robotics.
  • En planlagt multimodal modell med åpne vekter: Flux 3 Dev er planlagt som en grunnmodell med åpne vekter for video, lyd, bilder og handlingsforutsigelse. Black Forest Labs har ennå ikke publisert lanseringsdato, lisens, modellstørrelse, maskinvarekrav, API-priser eller endelige tester.
  • Definer scenen og referansene: Start med motiv, miljø, handling, kamerabevegelse, varighet, bildeforhold, dialog og lyd. Når Flux 3-tilgangen støtter referanser, kan du legge til et startbilde, en nøkkelramme eller et kildeklipp og angi detaljene som må forbli konsistente.
Multimodal modell fra Black Forest Labs

Flux 3 AI-video- og bildemodell

Flux 3 er Black Forest Labs' multimodale modell for video, bilder, innebygd lyd og handlingsforutsigelse. Utforsk bekreftede Flux 3-funksjoner og planer for tidlig tilgang.

Utforsk AI-video

Offisiell Flux 3-videofremvisning

Se fire lanseringsklipp publisert av Black Forest Labs 23. juli 2026. De offisielle Flux 3-klippene viser kystvær, racing i førsteperson, en dansesekvens mellom speil og varm leireanimasjon.

Flux 3-havdynamikk

Offisielt Flux 3-lanseringsklipp med stormbølger, sjøsprøyt og sjøfugler langs en kyst.

Flux 3-bevegelse i førsteperson

Offisielt Flux 3-lanseringsklipp som følger en motorsykkel på en regnvåt bane med raske kamerabevegelser, våt asfalt og banebarrierer.

Speil, vann og dans

Offisielt Flux 3-lanseringsklipp med selskapsdans blant speilarkitektur, vann, stearinlys og lagdelte refleksjoner.

Flux 3-stilisert figuranimasjon

Offisielt Flux 3-klipp med varm leireanimasjon, taktile materialer og figursentrert fysisk bevegelse.

Hva som skiller Flux 3

01 / Video • Lyd

Innebygd video med synkronisert lyd

Flux 3 kan generere varierte videoer med innebygd lyd i én operasjon, med klipp på opptil 20 sekunder i tidlig tilgang. Black Forest Labs fremhever synkronisert tale, lydeffekter og fysiske hendelser, men publiserte evalueringer er fortsatt foreløpige.

02 / Tekst • Bilde • Video

Multimodale inndata og referanser

Flux 3 støtter tekst-til-video, bilde-til-video, video-til-video og fortsettelse av video og lyd. Bilder kan brukes som startbilder eller visuelle referanser, mens kildeklipp kan ta en figur eller et sentralt element inn i en ny scene.

03 / Kontroll • Kontinuitet

Nøkkelbilder, lengre sekvenser og typografi

Flux 3 omfatter overganger fra nøkkelbilder til video, flerspråklig dialog, animert typografi, ulike bildeformater og agentisk sammenkobling av klipp. Black Forest Labs sier visuelle referanser kan bevare figurer mellom opptak, men uavhengig testing er fortsatt begrenset.

04 / Bilde • Handling

Én grunnmodell utover video

Flux 3 sikter også mot bildegenerering og -redigering samt handlingsforutsigelse fra samme multimodale grunnmodell. Tidlig bildetilgang planlegges etter videoforhåndsvisningen, mens handling starter med utvalgte partnere som mimic robotics.

05 / Dev • Åpne vekter

En planlagt multimodal modell med åpne vekter

Flux 3 Dev er planlagt som en grunnmodell med åpne vekter for video, lyd, bilder og handlingsforutsigelse. Black Forest Labs har ennå ikke publisert lanseringsdato, lisens, modellstørrelse, maskinvarekrav, API-priser eller endelige tester.

Slik passer Flux 3 inn i en videoproduksjon

Denne arbeidsflyten bygger på funksjoner annonsert av Black Forest Labs og er beregnet på godkjente brukere med tidlig tilgang. Funksjoner, grensesnitt og bruksvilkår kan endres før generell tilgjengelighet.

Definer scenen og referansene

Start med motiv, miljø, handling, kamerabevegelse, varighet, bildeforhold, dialog og lyd. Når Flux 3-tilgangen støtter referanser, kan du legge til et startbilde, en nøkkelramme eller et kildeklipp og angi detaljene som må forbli konsistente.

Generer og vurder hovedopptaket

Bruk Flux 3 til å lage hovedopptaket, og vurder deretter anatomi, objektstabilitet, leppesynkronisering, lydtiming, fysisk bevegelse, typografi og kamerakontinuitet. Endre én variabel om gangen i stedet for å skrive om hele ledeteksten etter hver forhåndsvisning.

Forleng, koble sammen og fullfør

Ifølge Black Forest Labs kan visuelle referanser og nøkkelrammer bidra til å koble klipp sammen til lengre sekvenser med flere opptak. Produksjonsbruk og offentlig deling er fortsatt underlagt gjeldende tilgangsvilkår og tillatelser for Flux 3.

Vanlige spørsmål om Flux 3

Utforsk AI-video mens Flux 3 rulles ut

Utforsk AI-video