クリエイターと映画制作者
ビデオカメラの率直な映像からアニメーションまで、ネイティブ オーディオ、多言語の対話、スタイルの多様性を備えた映画のようなクリップを生成します。一貫したキャラクターを持つ長いマルチショット シーケンスにクリップをチェーンします。
黒い森の研究所
Black Forest Labs の新しいマルチモーダル基盤モデルは、統一されたアーキテクチャ内で画像、ビデオ、オーディオから共同学習します。視覚的知性には、物体がどのように結合するか、物体がどのように動くか、イベントがどのように聞こえるかを理解する必要があるためです。
FLUX 3 はセルフフローに基づいて構築されており、同じアーキテクチャ内でマルチモーダルな生成と理解を効率的に調整し、ビデオ、画像、オーディオを同時にスケーリングします。
画像、ビデオ、オーディオは、異なるセンサーによってキャプチャされた同じ世界の投影です。 FLUX 3 はそれらすべてから一度に学習するため、サウンドは衝撃に一致し、動きは質量に従い、未来は過去から続きます。

Self-Flow に基づいて、BFL はコンピューティングとデータを大幅にスケールし、同じ基礎となるモデルで生成と理解をトレーニングし、品質と下流タスクのパフォーマンスの両方を向上させました。
FLUX 3 は、テキスト プロンプトから音声付きの画像とビデオを共同生成したり、画像やビデオ クリップなどの入力参照を組み合わせて文字、スタイル、コンテキストを新しいシーンに組み込むことができます。

FLUX 3 は、現実世界のビジュアル インテリジェンス、つまり物理環境とデジタル環境全体で認識、予測、動作するモデルを開発するという BFL の使命のチェックポイントです。
Black Forest Labs は、FLUX 3 機能を段階的に展開しています。それぞれの機能は、同じ基盤となるマルチモーダル フロー マッチング モデルから構築されており、フィードバックと安全性テストのための早期アクセスが可能です。
FLUX 3 は、クリエイター、マーケティング担当者、デザイナー、ロボット工学チーム、そして単なる単一モダリティのコンバーターではなく、インテリジェントなクリエイティブ パートナーを求めるすべての人向けに構築されています。
ビデオカメラの率直な映像からアニメーションまで、ネイティブ オーディオ、多言語の対話、スタイルの多様性を備えた映画のようなクリップを生成します。一貫したキャラクターを持つ長いマルチショット シーケンスにクリップをチェーンします。
エージェントの推論を使用して、キャンペーンのコンセプト、洗練されたバリエーション、タイポグラフィーを多用したデザインを作成します。参照内のグラウンド生成と、画像とビデオのワークフロー全体での反復処理が高速化されます。

FLUX 3 の世界理解をアクション予測に使用します。 FLUX-mimic は、限られたタスク固有のデータを使用して巧みに操作できるようにビデオ バックボーンを微調整し、コンテンツ作成と物理 AI の橋渡しをします。
インタラクティブな画像やビデオの編集から、シミュレーション、コンピューターの使用、物理 AI まで、FLUX 3 は幅広いフロンティアを開きます。ビデオ生成は現在早期アクセスで利用できます。
1 つの統合モデルがビデオ、画像、アクションを強化します。各モダリティは、画像、ビデオ、オーディオにわたって訓練された共有世界の理解を活用します。
テキストからビデオへ、画像からビデオへのアニメーション、ビデオからビデオへのリファレンス転送、生成的なビデオとオーディオの継続、およびキーフレームからビデオへの制御 - すべてが同期されたネイティブ オーディオ生成によって行われます。
人間の表情のキャプチャ、音と物理的出来事の関連付け、多言語対話の生成に優れており、機能を組み合わせて数分間のシーケンスを作成します。
ビデオカメラの率直な映像からアニメーションや映画まで幅広く扱います。幅広いビジュアルスタイルとアスペクト比にわたる強力なタイポグラフィー生成とアニメーションデザイン。
個々のクリップをより長いマルチショット シーケンスにチェーンします。視覚的な参照は、拡張された物語全体のすべてのシーンでキャラクターの一貫性を保つのに役立ちます。
さまざまなスタイル、アスペクト比、解像度で画像を合成および編集します。複雑なプロンプト遵守と複数言語での高精度のテキスト レンダリングが改善されました。
FLUX 3 に直接統合されたネイティブ アクション予測に加え、ダイナミクスを意識した基盤として事前トレーニングされたビデオ バックボーンを使用して、FLUX-mimic のような微調整された特殊なモデルを追加します。
720p のテキストからビデオへの予備評価では、直接比較した場合、FLUX 3 がいくつかの主要モデルよりも好まれ、早期アクセス中にさらなる改善が期待されました。
すべての機能は、同じ基盤となるマルチモーダル フロー マッチング モデルから構築されており、早期アクセスを通じて段階的にリリースされます。
ネイティブオーディオ、マルチショットチェイニング、リファレンスベースのワークフローによるビデオとオーディオの生成と編集。早期アクセスで利用可能です。

改善されたプロンプト処理、スタイルの多様性、および多言語テキストのレンダリングによる画像の合成と編集。早期アクセスは数週間以内に開始されます。

統合されたビジュアル インテリジェンスを基盤とする研究者や開発者向けの、コンテンツ作成とアクション予測のためのオープンウェイト マルチモーダル バックボーン。

FLUX 3 バックボーンとロボット工学の専門知識を組み合わせたビデオアクション モデルで、器用な操作とプロダクション展開を実現します。
Black Forest Labs の FLUX 3 を探索し、プラットフォームで制作を始めましょう。
このページには、Black Forest Labs から FLUX 3 について公開されている情報がまとめられています。当社はBFLとは提携しておりません。