Model wideo i obrazu AI Flux 3

Model wideo i obrazu AI Flux 3

Flux 3 to multimodalny model Black Forest Labs dla wideo, obrazów, natywnego dźwięku i przewidywania działań. Poznaj potwierdzone funkcje Flux 3 i plany wczesnego dostępu.

  • Natywne wideo z zsynchronizowanym dźwiękiem: Flux 3 może jednocześnie generować różnorodne wideo i natywny dźwięk, we wczesnym dostępie w klipach do 20 sekund. Black Forest Labs podkreśla synchronizację mowy, efektów i zdarzeń fizycznych, lecz opublikowane oceny są nadal wstępne.
  • Multimodalne dane wejściowe i referencje: Flux 3 obsługuje tekst na wideo, obraz na wideo, wideo na wideo oraz kontynuację wideo z dźwiękiem. Obrazy mogą być klatkami początkowymi lub referencjami, a klipy źródłowe mogą przenosić postać lub główny element do nowej sceny.
  • Klatki kluczowe, dłuższe sekwencje i typografia: Flux 3 oferuje przejścia od klatek kluczowych do wideo, wielojęzyczne dialogi, animowaną typografię, różne proporcje obrazu i agentowe łączenie klipów. Według Black Forest Labs referencje wizualne pomagają zachować postacie między ujęciami, ale niezależne testy są nadal ograniczone.
  • Jeden model bazowy poza wideo: Flux 3 ma także syntetyzować i edytować obrazy oraz przewidywać działania z tej samej multimodalnej bazy. Wczesny dostęp do obrazów zaplanowano po podglądzie wideo, a funkcje działań zaczynają od wybranych partnerów, takich jak mimic robotics.
  • Planowany multimodalny model z otwartymi wagami: Flux 3 Dev jest planowany jako baza z otwartymi wagami dla wideo, dźwięku, obrazów i przewidywania działań. Black Forest Labs nie podało jeszcze daty premiery, licencji, rozmiaru modelu, wymagań sprzętowych, cen API ani końcowych benchmarków.
  • Zdefiniuj scenę i materiały referencyjne: Zacznij od bohatera, otoczenia, akcji, ruchu kamery, czasu trwania, proporcji obrazu, dialogu i dźwięku. Gdy dostęp do Flux 3 obsługuje materiały referencyjne, dodaj obraz początkowy, klatkę kluczową lub klip źródłowy i wskaż szczegóły, które muszą pozostać spójne.
Model multimodalny Black Forest Labs

Model wideo i obrazu AI Flux 3

Flux 3 to multimodalny model Black Forest Labs dla wideo, obrazów, natywnego dźwięku i przewidywania działań. Poznaj potwierdzone funkcje Flux 3 i plany wczesnego dostępu.

Odkryj wideo AI

Oficjalna prezentacja wideo Flux 3

Obejrzyj cztery próbki premierowe opublikowane przez Black Forest Labs 23 lipca 2026 r. Te oficjalne klipy Flux 3 pokazują pogodę na wybrzeżu, wyścig z perspektywy pierwszej osoby, taniec pośród luster i ciepłą animację z plasteliny.

Dynamika oceanu Flux 3

Oficjalna próbka premierowa Flux 3 pokazująca sztormowe fale, bryzę wodną i ptaki morskie wzdłuż wybrzeża.

Ruch pierwszoosobowy Flux 3

Oficjalna próbka premierowa Flux 3 śledząca motocykl na mokrym torze, z szybkimi ruchami kamery, mokrym asfaltem i barierami przy torze.

Lustra, woda i taniec

Oficjalna próbka premierowa Flux 3 pokazująca taniec w sali balowej pośród lustrzanej architektury, wody, światła świec i wielowarstwowych odbić.

Stylizowana animacja postaci Flux 3

Oficjalna próbka Flux 3 z ciepłą animacją z gliny, namacalnymi materiałami i ruchem skupionym na postaci.

Co wyróżnia Flux 3

01 / Wideo • Dźwięk

Natywne wideo z zsynchronizowanym dźwiękiem

Flux 3 może jednocześnie generować różnorodne wideo i natywny dźwięk, we wczesnym dostępie w klipach do 20 sekund. Black Forest Labs podkreśla synchronizację mowy, efektów i zdarzeń fizycznych, lecz opublikowane oceny są nadal wstępne.

02 / Tekst • Obraz • Wideo

Multimodalne dane wejściowe i referencje

Flux 3 obsługuje tekst na wideo, obraz na wideo, wideo na wideo oraz kontynuację wideo z dźwiękiem. Obrazy mogą być klatkami początkowymi lub referencjami, a klipy źródłowe mogą przenosić postać lub główny element do nowej sceny.

03 / Kontrola • Ciągłość

Klatki kluczowe, dłuższe sekwencje i typografia

Flux 3 oferuje przejścia od klatek kluczowych do wideo, wielojęzyczne dialogi, animowaną typografię, różne proporcje obrazu i agentowe łączenie klipów. Według Black Forest Labs referencje wizualne pomagają zachować postacie między ujęciami, ale niezależne testy są nadal ograniczone.

04 / Obraz • Działanie

Jeden model bazowy poza wideo

Flux 3 ma także syntetyzować i edytować obrazy oraz przewidywać działania z tej samej multimodalnej bazy. Wczesny dostęp do obrazów zaplanowano po podglądzie wideo, a funkcje działań zaczynają od wybranych partnerów, takich jak mimic robotics.

05 / Dev • Otwarte wagi

Planowany multimodalny model z otwartymi wagami

Flux 3 Dev jest planowany jako baza z otwartymi wagami dla wideo, dźwięku, obrazów i przewidywania działań. Black Forest Labs nie podało jeszcze daty premiery, licencji, rozmiaru modelu, wymagań sprzętowych, cen API ani końcowych benchmarków.

Jak Flux 3 wpisuje się w proces produkcji wideo

Ten proces opiera się na funkcjach zapowiedzianych przez Black Forest Labs i jest przeznaczony dla zatwierdzonych użytkowników wczesnego dostępu. Funkcje, interfejsy i warunki użytkowania mogą się zmienić przed ogólną dostępnością.

Zdefiniuj scenę i materiały referencyjne

Zacznij od bohatera, otoczenia, akcji, ruchu kamery, czasu trwania, proporcji obrazu, dialogu i dźwięku. Gdy dostęp do Flux 3 obsługuje materiały referencyjne, dodaj obraz początkowy, klatkę kluczową lub klip źródłowy i wskaż szczegóły, które muszą pozostać spójne.

Wygeneruj i oceń główne ujęcie

Użyj Flux 3 do stworzenia głównego ujęcia, a następnie sprawdź anatomię, trwałość obiektów, synchronizację ust, timing dźwięku, ruch fizyczny, typografię i ciągłość kamery. Zmieniaj jedną zmienną naraz zamiast przepisywać cały prompt po każdym podglądzie.

Rozwijaj, łącz i wykańczaj

Według Black Forest Labs odniesienia wizualne i klatki kluczowe mogą pomóc łączyć klipy w dłuższe sekwencje wieloujęciowe. Użycie produkcyjne i publiczne udostępnianie nadal podlegają odpowiednim warunkom i uprawnieniom dostępu do Flux 3.

Najczęstsze pytania o Flux 3

Odkryj wideo AI podczas wdrażania Flux 3

Odkryj wideo AI