창작자와 영화제작자
자연스러운 캠코더 영상부터 애니메이션까지 네이티브 오디오, 다국어 대화, 스타일 다양성을 갖춘 영화 클립을 생성하세요. 일관된 문자를 사용하여 클립을 더 긴 멀티샷 시퀀스로 연결합니다.
블랙 포레스트 연구소
Black Forest Labs의 새로운 다중 모드 기반 모델은 통합 아키텍처 내에서 이미지, 비디오 및 오디오를 통해 공동으로 학습합니다. 왜냐하면 시각적 지능을 위해서는 물체가 서로 어떻게 결합되어 있는지, 사물이 어떻게 움직이는지, 사건이 어떻게 들리는지 이해해야 하기 때문입니다.
FLUX 3는 비디오, 이미지 및 오디오 전반에 걸쳐 동시에 확장되는 동일한 아키텍처 내에서 멀티모달 생성 및 이해를 효율적으로 정렬하는 Self-Flow를 기반으로 구축되었습니다.
이미지, 비디오, 오디오는 서로 다른 센서로 포착한 동일한 세계의 투영입니다. FLUX 3는 이 모든 것을 동시에 학습하므로 소리는 충격과 일치하고 동작은 질량을 따르며 미래는 과거에서 따릅니다.

Self-Flow를 기반으로 BFL은 동일한 기본 모델에서 생성 및 이해를 교육하기 위해 컴퓨팅과 데이터를 크게 확장하여 품질과 다운스트림 작업 성능을 모두 향상했습니다.
FLUX 3는 텍스트 프롬프트에서 오디오와 함께 이미지와 비디오를 생성하거나 이미지 및 비디오 클립과 같은 입력 참조를 결합하여 문자, 스타일 및 컨텍스트를 새로운 장면에 전달할 수 있습니다.

FLUX 3는 실제 시각 지능, 즉 물리적 환경과 디지털 환경 전반에 걸쳐 인식하고 예측하고 행동하는 모델을 개발하려는 BFL의 사명에 대한 체크포인트입니다.
Black Forest Labs는 FLUX 3 기능을 단계적으로 출시하고 있습니다. 각각은 피드백 및 안전 테스트를 위한 조기 액세스와 함께 동일한 기본 다중 모드 흐름 일치 모델로 구축되었습니다.
FLUX 3는 제작자, 마케팅 담당자, 디자이너, 로봇공학 팀 및 단순한 단일 형식 변환기가 아닌 지능형 크리에이티브 파트너를 원하는 모든 사람을 위해 제작되었습니다.
자연스러운 캠코더 영상부터 애니메이션까지 네이티브 오디오, 다국어 대화, 스타일 다양성을 갖춘 영화 클립을 생성하세요. 일관된 문자를 사용하여 클립을 더 긴 멀티샷 시퀀스로 연결합니다.
행위적 추론을 통해 캠페인 컨셉, 세련된 변형, 타이포그래피가 많은 디자인을 제작하세요. 참조 세대를 기반으로 하고 이미지 및 비디오 워크플로 전반에서 더 빠르게 반복합니다.

행동 예측을 위해 FLUX 3의 세계 이해를 사용하세요. FLUX-mimic은 제한된 작업별 데이터를 사용하여 능숙하게 조작할 수 있도록 비디오 백본을 미세 조정하여 콘텐츠 생성과 물리적 AI를 연결합니다.
대화형 이미지 및 비디오 편집에서 시뮬레이션, 컴퓨터 사용 및 물리적 AI에 이르기까지 FLUX 3는 넓은 영역을 열어줍니다. 비디오 생성은 오늘부터 얼리 액세스로 제공됩니다.
하나의 통합 모델은 비디오, 이미지 및 작업을 지원합니다. 각 양식은 이미지, 비디오 및 오디오 전반에 걸쳐 훈련된 공유 세계 이해의 이점을 얻습니다.
텍스트-비디오, 이미지-비디오 애니메이션, 비디오-비디오 참조 전송, 생성적 비디오-오디오 연속, 키프레임-비디오 제어 등 모두 동기화된 기본 오디오 생성 기능을 갖추고 있습니다.
인간의 얼굴 표정을 포착하고, 소리를 물리적 이벤트와 연관시키고, 다국어 대화를 생성하는 데 강력하며 기능을 몇 분 동안 지속되는 시퀀스로 결합합니다.
자연스러운 캠코더 영상부터 애니메이션, 영화까지 다양한 범위를 처리합니다. 광범위한 시각적 스타일과 종횡비에 걸친 강력한 타이포그래피 생성 및 애니메이션 디자인.
개별 클립을 더 긴 다중 샷 시퀀스로 연결합니다. 시각적 참조는 확장된 내러티브 전반에 걸쳐 모든 장면에서 캐릭터의 일관성을 유지하는 데 도움이 됩니다.
다양한 스타일, 종횡비 및 해상도로 이미지를 합성하고 편집합니다. 복잡한 프롬프트 준수 및 여러 언어의 정확도 높은 텍스트 렌더링이 개선되었습니다.
FLUX 3에 직접 통합된 기본 동작 예측과 FLUX-mimic과 같은 미세 조정된 특수 모델은 사전 훈련된 비디오 백본을 역학 인식 기반으로 사용합니다.
예비 720p 텍스트-비디오 평가에서 FLUX 3는 정면 비교에서 여러 주요 모델보다 선호되었으며 초기 액세스 동안 추가 개선이 예상되었습니다.
모든 기능은 동일한 기본 다중 모드 흐름 일치 모델을 기반으로 구축되었으며 조기 액세스를 통해 단계적으로 출시되었습니다.
네이티브 오디오, 멀티샷 체인, 참조 기반 워크플로를 사용한 비디오 및 오디오 생성 및 편집. 얼리 액세스로 이용 가능합니다.

향상된 프롬프트 처리, 스타일 다양성 및 다국어 텍스트 렌더링을 통한 이미지 합성 및 편집. 다음 주에 조기 액세스가 시작됩니다.

콘텐츠 생성 및 행동 예측을 위한 개방형 다중 모드 백본 - 통합된 시각적 지능을 기반으로 구축하는 연구원 및 개발자를 위한 것입니다.

FLUX 3 백본과 능숙한 조작 및 생산 배포를 위한 로봇 전문 지식을 결합한 비디오 액션 모델입니다.
Black Forest Labs의 FLUX 3를 살펴보고 플랫폼으로 제작을 시작해 보세요.
이 페이지에는 Black Forest Labs에서 FLUX 3에 대해 공개적으로 사용 가능한 정보가 요약되어 있습니다. 우리는 BFL과 제휴하지 않습니다.