Kara Orman Laboratuvarları

FLUX 3 — Gerçek Dünya Modelleri

Black Forest Labs'ın yeni çok modlu temel modeli, birleşik bir mimari içerisinde görüntülerden, videolardan ve seslerden ortaklaşa öğrenir; çünkü görsel zeka, nesnelerin nasıl bir arada tutulduğunu, nesnelerin nasıl hareket ettiğini ve olayların nasıl ses çıkardığını anlamayı gerektirir.

FLUX 3 ile oluşturun

Görüntüleri ve videoları tek bir yerde oluşturun; ana sayfadan ayrılmadan modlar arasında geçiş yapın.

0 / 5000

Gerekli krediler:50

Sample Image

(Oluşturulan Görüntü sonuçları burada görünecektir)

Sample result

FLUX 3, multimodal üretimi ve anlayışı aynı mimari içinde verimli bir şekilde hizalayan ve aynı anda video, görüntü ve ses arasında ölçeklenen Self-Flow üzerine kurulmuştur.

FLUX 3 neden multimodal üretimi değiştiriyor?

Tek model, temeldeki tek gerçeklik

Görüntüler, videolar ve sesler aynı dünyanın farklı sensörler tarafından yakalanan projeksiyonlarıdır. FLUX 3 bunların hepsinden aynı anda öğrenir, böylece ses darbeyle eşleşir, hareket kütleye itaat eder ve gelecek geçmişten gelir.

Kendi Kendine Akış mimarisi

Kendi Kendine Akış mimarisi

Self-Flow'u temel alan BFL, aynı temel modelde üretim ve anlayışı eğitmek için bilgi işlem ve verileri önemli ölçüde ölçeklendirerek hem kaliteyi hem de aşağı yönlü görev performansını artırdı.

Modaliteleri özgürce karıştırın

FLUX 3, metin komutlarından ortaklaşa görseller ve sesli videolar oluşturabilir veya karakterleri, stilleri ve bağlamı yeni sahnelere taşımak için görüntüler ve video klipler gibi giriş referanslarını birleştirebilir.

Görsel zekaya doğru

Görsel zekaya doğru

FLUX 3, BFL'in gerçek dünyadaki görsel zekayı geliştirme misyonunda bir kontrol noktasıdır: fiziksel ve dijital ortamlarda algılayan, tahmin eden ve hareket eden modeller.

Black Forest Labs, her biri aynı temel multimodal akış eşleştirme modelinden oluşturulmuş, geri bildirim ve güvenlik testleri için erken erişimle birlikte FLUX 3 yeteneklerini aşamalı olarak kullanıma sunuyor.

FLUX 3 lansman planı

FLUX 3 yaratıcılar, pazarlamacılar, tasarımcılar, robotik ekipleri ve yalnızca tek modlu bir dönüştürücü değil, akıllı bir yaratıcı ortak isteyen herkes için geliştirildi.

FLUX 3 kimler içindir

Yaratıcılar ve film yapımcıları

Samimi kamera çekimlerinden animasyona kadar yerel ses, çok dilli diyalog ve stil çeşitliliğine sahip sinematik klipler oluşturun. Klipleri tutarlı karakterlerle daha uzun çoklu çekim dizileri halinde zincirleyin.

Pazarlamacılar ve görsel ekipler

Eylemsel akıl yürütmeyle kampanya konseptleri, gösterişli varyantlar ve tipografi ağırlıklı tasarımlar üretin. Referanslardaki nesilleri temel alın ve görüntü ve video iş akışlarında daha hızlı yineleyin.

Fiziksel yapay zeka ve robotik

Fiziksel yapay zeka ve robotik

Eylem tahmini için FLUX 3'ün dünya anlayışını kullanın. FLUX-mimic, sınırlı göreve özel verilerle ustaca manipülasyon için video omurgasına ince ayar yaparak içerik oluşturma ve fiziksel yapay zeka arasında köprü kurar.

Görsel zekanın bir sonraki omurgası

Etkileşimli görüntü ve video düzenlemeden simülasyona, bilgisayar kullanımına ve fiziksel yapay zekaya kadar FLUX 3 geniş bir ufuk açıyor. Video oluşturma bugün erken erişimde mevcuttur.

Tek bir birleşik model video, görüntü ve eylemi destekler; her yöntem görüntüler, videolar ve ses üzerinden eğitilen ortak dünya anlayışından yararlanır.

FLUX 3 yetenekleri

Yerel sesli video (20 saniyeye kadar)

Metinden videoya, görüntüden videoya animasyon, videodan videoya referans aktarımı, üretken video-ses devamlılığı ve ana kareden videoya kontrol — tümü senkronize yerel ses üretimiyle.

Çok dilli diyalog ve ses tasarımı

İnsan yüz ifadelerini yakalama, sesleri fiziksel olaylarla ilişkilendirme ve çok dilli diyalog oluşturma konusunda güçlü; yetenekleri birkaç dakika süren diziler halinde birleştiriyor.

Stil çeşitliliği ve tipografi

İşleme, samimi kamera görüntülerinden animasyon ve sinemaya kadar uzanır. Çok çeşitli görsel stiller ve en boy oranlarında güçlü tipografi oluşturma ve animasyonlu tasarımlar.

Ajansal çoklu atış zincirleme

Bireysel klipleri daha uzun, çok çekimli dizilere zincirleyin. Görsel referanslar, genişletilmiş anlatılar boyunca karakterlerin tüm sahnelerde tutarlı kalmasını sağlamaya yardımcı olur.

Görüntü sentezi ve düzenleme

Çok çeşitli stillerde, en boy oranlarında ve çözünürlüklerde görüntüleri sentezleyin ve düzenleyin. Birden fazla dilde geliştirilmiş karmaşık istem uyumu ve yüksek doğrulukta metin oluşturma.

Eylem tahmini

Doğrudan FLUX 3'e entegre edilen yerel eylem tahmininin yanı sıra, önceden eğitilmiş video omurgasını dinamiğe duyarlı bir temel olarak kullanan FLUX-mimic gibi ince ayarlı özel modeller.

Erken kıyaslama performansı

Ön 720p metinden videoya değerlendirmelerde, bire bir karşılaştırmalarda FLUX 3 önde gelen birçok modele göre tercih edildi; erken erişim sırasında daha fazla iyileştirme yapılması bekleniyor.

FLUX 3 hakkında sık sorulan sorular

Bu sayfa Black Forest Laboratuvarlarından FLUX 3 hakkında kamuya açık bilgileri özetlemektedir. BFL'ye bağlı değiliz.