Flux 3 AI 비디오 및 이미지 모델

Flux 3 AI 비디오 및 이미지 모델

Flux 3는 비디오, 이미지, 네이티브 오디오, 행동 예측을 위한 Black Forest Labs의 멀티모달 모델입니다. 확인된 Flux 3 기능과 얼리 액세스 계획을 살펴보세요.

  • 동기화 오디오가 포함된 네이티브 비디오: Flux 3는 얼리 액세스에서 최대 20초의 다양한 비디오와 네이티브 오디오를 한 번에 생성할 수 있습니다. Black Forest Labs는 음성, 효과음, 물리적 사건의 동기화를 강조하지만 공개된 평가는 아직 예비 단계입니다.
  • 멀티모달 입력과 참조: Flux 3는 텍스트-투-비디오, 이미지-투-비디오, 비디오-투-비디오, 비디오·오디오 연장을 지원합니다. 이미지는 시작 프레임이나 시각 참조로 사용하고, 원본 클립의 인물이나 핵심 요소를 새 장면으로 이어갈 수 있습니다.
  • 키프레임, 긴 시퀀스, 타이포그래피: Flux 3는 키프레임-투-비디오 전환, 다국어 대화, 애니메이션 타이포그래피, 다양한 화면 비율, 에이전트식 클립 연결을 포함합니다. 시각 참조가 여러 숏에서 인물을 유지하는 데 도움을 준다고 하지만 독립 검증은 아직 제한적입니다.
  • 비디오를 넘어선 하나의 백본: Flux 3는 같은 멀티모달 백본에서 이미지 생성·편집과 행동 예측도 목표로 합니다. 이미지 얼리 액세스는 비디오 미리보기 뒤에 예정되어 있고, 행동 기능은 mimic robotics 같은 선정된 연구·상용 파트너부터 시작합니다.
  • 예정된 오픈 웨이트 멀티모달 모델: Flux 3 Dev는 비디오, 오디오, 이미지, 행동 예측용 오픈 웨이트 백본으로 계획되어 있습니다. Black Forest Labs는 출시일, 라이선스, 모델 크기, 하드웨어 요구 사항, API 가격, 최종 프로덕션 벤치마크를 아직 공개하지 않았습니다.
  • 장면과 참조 자료 정의하기: 피사체, 환경, 동작, 카메라 움직임, 길이, 화면 비율, 대사, 사운드부터 정리하세요. Flux 3 이용 환경에서 참조 입력을 지원한다면 시작 이미지, 키프레임 또는 원본 클립을 추가하고 일관되게 유지해야 할 세부 요소를 지정하세요.
Black Forest Labs 멀티모달 모델

Flux 3 AI 비디오 및 이미지 모델

Flux 3는 비디오, 이미지, 네이티브 오디오, 행동 예측을 위한 Black Forest Labs의 멀티모달 모델입니다. 확인된 Flux 3 기능과 얼리 액세스 계획을 살펴보세요.

AI 비디오 살펴보기

Flux 3 공식 비디오 쇼케이스

Black Forest Labs가 2026년 7월 23일 공개한 네 가지 출시 샘플을 확인하세요. Flux 3 공식 영상은 해안의 날씨, 1인칭 레이싱, 거울 속 댄스 장면, 따뜻한 클레이 애니메이션을 보여줍니다.

Flux 3 해양 역학

폭풍이 이는 파도와 물보라, 해안을 따라 움직이는 바닷새를 담은 Flux 3 공식 출시 샘플입니다.

Flux 3 1인칭 모션

젖은 서킷을 달리는 오토바이를 빠른 카메라 움직임, 젖은 아스팔트, 트랙 방호벽과 함께 담은 Flux 3 공식 출시 샘플입니다.

거울, 물, 그리고 춤

거울 건축물과 물, 촛불, 겹겹의 반사 사이에서 펼쳐지는 볼룸 댄스를 담은 Flux 3 공식 출시 샘플입니다.

Flux 3 스타일화 캐릭터 애니메이션

Flux 3 공식 출시 영상으로, 따뜻한 클레이 애니메이션과 촉감 있는 재질, 캐릭터 중심의 물리적 움직임을 담았습니다.

Flux 3의 차별점

01 / 비디오 • 오디오

동기화 오디오가 포함된 네이티브 비디오

Flux 3는 얼리 액세스에서 최대 20초의 다양한 비디오와 네이티브 오디오를 한 번에 생성할 수 있습니다. Black Forest Labs는 음성, 효과음, 물리적 사건의 동기화를 강조하지만 공개된 평가는 아직 예비 단계입니다.

02 / 텍스트 • 이미지 • 비디오

멀티모달 입력과 참조

Flux 3는 텍스트-투-비디오, 이미지-투-비디오, 비디오-투-비디오, 비디오·오디오 연장을 지원합니다. 이미지는 시작 프레임이나 시각 참조로 사용하고, 원본 클립의 인물이나 핵심 요소를 새 장면으로 이어갈 수 있습니다.

03 / 제어 • 연속성

키프레임, 긴 시퀀스, 타이포그래피

Flux 3는 키프레임-투-비디오 전환, 다국어 대화, 애니메이션 타이포그래피, 다양한 화면 비율, 에이전트식 클립 연결을 포함합니다. 시각 참조가 여러 숏에서 인물을 유지하는 데 도움을 준다고 하지만 독립 검증은 아직 제한적입니다.

04 / 이미지 • 행동

비디오를 넘어선 하나의 백본

Flux 3는 같은 멀티모달 백본에서 이미지 생성·편집과 행동 예측도 목표로 합니다. 이미지 얼리 액세스는 비디오 미리보기 뒤에 예정되어 있고, 행동 기능은 mimic robotics 같은 선정된 연구·상용 파트너부터 시작합니다.

05 / Dev • 오픈 웨이트

예정된 오픈 웨이트 멀티모달 모델

Flux 3 Dev는 비디오, 오디오, 이미지, 행동 예측용 오픈 웨이트 백본으로 계획되어 있습니다. Black Forest Labs는 출시일, 라이선스, 모델 크기, 하드웨어 요구 사항, API 가격, 최종 프로덕션 벤치마크를 아직 공개하지 않았습니다.

영상 제작 워크플로에서의 Flux 3

이 워크플로는 Black Forest Labs가 발표한 기능을 바탕으로 하며 승인된 얼리 액세스 사용자를 위한 것입니다. 정식 출시 전에는 기능, 인터페이스 및 이용 조건이 변경될 수 있습니다.

장면과 참조 자료 정의하기

피사체, 환경, 동작, 카메라 움직임, 길이, 화면 비율, 대사, 사운드부터 정리하세요. Flux 3 이용 환경에서 참조 입력을 지원한다면 시작 이미지, 키프레임 또는 원본 클립을 추가하고 일관되게 유지해야 할 세부 요소를 지정하세요.

핵심 샷 생성 및 평가하기

Flux 3로 메인 샷을 만든 뒤 인체 구조, 객체 지속성, 립싱크, 오디오 타이밍, 물리적 움직임, 타이포그래피, 카메라 연속성을 검토하세요. 미리보기마다 전체 프롬프트를 다시 쓰기보다 한 번에 하나의 변수만 바꾸세요.

연장하고 연결해 마무리하기

Black Forest Labs에 따르면 시각적 참조와 키프레임을 활용해 여러 클립을 더 긴 멀티샷 시퀀스로 연결할 수 있습니다. 프로덕션 사용과 공개 공유에는 해당 Flux 3 액세스 조건과 권한이 적용됩니다.

Flux 3 자주 묻는 질문

Flux 3 출시를 기다리며 AI 비디오 살펴보기

AI 비디오 살펴보기