Модель для видео и изображений Flux 3

Модель для видео и изображений Flux 3

Flux 3 — мультимодальная модель Black Forest Labs для видео, изображений, нативного звука и прогнозирования действий. Изучите подтверждённые функции Flux 3 и планы раннего доступа.

  • Нативное видео с синхронным звуком: Flux 3 может за один проход создавать разнообразные видео с нативным звуком; в раннем доступе длительность клипа достигает 20 секунд. Black Forest Labs отмечает синхронизацию речи, эффектов и физических событий, но опубликованные оценки пока предварительные.
  • Мультимодальные входные данные и референсы: Flux 3 поддерживает преобразование текста, изображений и видео в видео, а также продолжение видео со звуком. Изображение может стать первым кадром или визуальным референсом, а исходный клип — перенести персонажа или ключевой элемент в новую сцену.
  • Ключевые кадры, длинные сцены и типографика: Flux 3 включает переходы между ключевыми кадрами, многоязычные диалоги, анимированную типографику, разные соотношения сторон и агентное объединение клипов. По данным Black Forest Labs, визуальные референсы помогают сохранять персонажей между планами, но независимых тестов пока мало.
  • Единая основа не только для видео: Flux 3 также нацелен на генерацию и редактирование изображений и прогнозирование действий на одной мультимодальной основе. Ранний доступ к изображениям запланирован после видео, а действия сначала доступны избранным партнёрам, включая mimic robotics.
  • Планируемая мультимодальная модель с открытыми весами: Flux 3 Dev планируется как основа с открытыми весами для видео, аудио, изображений и прогнозирования действий. Black Forest Labs ещё не сообщила дату выпуска, лицензию, размер модели, требования к оборудованию, цены API и итоговые тесты.
  • Определите сцену и референсы: Начните с объекта, окружения, действия, движения камеры, длительности, соотношения сторон, диалога и звука. Если ваш доступ к Flux 3 поддерживает референсы, добавьте начальное изображение, ключевой кадр или исходный клип и укажите детали, которые должны оставаться неизменными.
Мультимодальная модель Black Forest Labs

Модель для видео и изображений Flux 3

Flux 3 — мультимодальная модель Black Forest Labs для видео, изображений, нативного звука и прогнозирования действий. Изучите подтверждённые функции Flux 3 и планы раннего доступа.

Попробовать ИИ-видео

Официальная видеогалерея Flux 3

Посмотрите четыре стартовых примера, опубликованных Black Forest Labs 23 июля 2026 года. Эти официальные ролики Flux 3 показывают прибрежную непогоду, гонку от первого лица, танцевальную сцену среди зеркал и тёплую пластилиновую анимацию.

Динамика океана Flux 3

Официальный стартовый пример Flux 3 со штормовыми волнами, брызгами и морскими птицами у побережья.

Движение от первого лица Flux 3

Официальный стартовый пример Flux 3 с мотоциклом на мокрой трассе, быстрым движением камеры, влажным асфальтом и ограждениями трека.

Зеркала, вода и танец

Официальный стартовый пример Flux 3 с бальным танцем среди зеркальной архитектуры, воды, свечей и многослойных отражений.

Стилизованная анимация персонажей Flux 3

Официальный пример Flux 3 с тёплой пластилиновой анимацией, осязаемыми материалами и движением персонажа.

Чем отличается Flux 3

01 / Видео • Аудио

Нативное видео с синхронным звуком

Flux 3 может за один проход создавать разнообразные видео с нативным звуком; в раннем доступе длительность клипа достигает 20 секунд. Black Forest Labs отмечает синхронизацию речи, эффектов и физических событий, но опубликованные оценки пока предварительные.

02 / Текст • Изображение • Видео

Мультимодальные входные данные и референсы

Flux 3 поддерживает преобразование текста, изображений и видео в видео, а также продолжение видео со звуком. Изображение может стать первым кадром или визуальным референсом, а исходный клип — перенести персонажа или ключевой элемент в новую сцену.

03 / Контроль • Непрерывность

Ключевые кадры, длинные сцены и типографика

Flux 3 включает переходы между ключевыми кадрами, многоязычные диалоги, анимированную типографику, разные соотношения сторон и агентное объединение клипов. По данным Black Forest Labs, визуальные референсы помогают сохранять персонажей между планами, но независимых тестов пока мало.

04 / Изображение • Действие

Единая основа не только для видео

Flux 3 также нацелен на генерацию и редактирование изображений и прогнозирование действий на одной мультимодальной основе. Ранний доступ к изображениям запланирован после видео, а действия сначала доступны избранным партнёрам, включая mimic robotics.

05 / Dev • Открытые веса

Планируемая мультимодальная модель с открытыми весами

Flux 3 Dev планируется как основа с открытыми весами для видео, аудио, изображений и прогнозирования действий. Black Forest Labs ещё не сообщила дату выпуска, лицензию, размер модели, требования к оборудованию, цены API и итоговые тесты.

Как Flux 3 вписывается в процесс видеопроизводства

Этот процесс основан на возможностях, заявленных Black Forest Labs, и предназначен для одобренных участников раннего доступа. Функции, интерфейсы и условия использования могут измениться до общедоступного выпуска.

Определите сцену и референсы

Начните с объекта, окружения, действия, движения камеры, длительности, соотношения сторон, диалога и звука. Если ваш доступ к Flux 3 поддерживает референсы, добавьте начальное изображение, ключевой кадр или исходный клип и укажите детали, которые должны оставаться неизменными.

Создайте и оцените основной кадр

Создайте основной кадр в Flux 3, затем проверьте анатомию, устойчивость объектов, синхронизацию губ, тайминг звука, физическое движение, типографику и непрерывность камеры. Меняйте по одной переменной, а не переписывайте весь промпт после каждого предпросмотра.

Продлите, свяжите и завершите

По данным Black Forest Labs, визуальные референсы и ключевые кадры помогают объединять клипы в более длинные многокадровые последовательности. Производственное использование и публичная публикация регулируются применимыми условиями и разрешениями доступа к Flux 3.

Частые вопросы о Flux 3

Создавайте ИИ-видео, пока разворачивается Flux 3

Попробовать ИИ-видео