Zwarte Woud-laboratoria

FLUX 3 — Modellen uit de echte wereld

Het nieuwe multimodale basismodel van Black Forest Labs leert gezamenlijk van afbeeldingen, video's en audio binnen een uniforme architectuur - omdat visuele intelligentie inzicht vereist in hoe objecten bij elkaar blijven, hoe dingen bewegen en hoe gebeurtenissen klinken.

Creëer met FLUX 3

Genereer afbeeldingen en video's op één plek: schakel tussen modi zonder de startpagina te verlaten.

0 / 5000

Vereiste tegoeden:50

Sample Image

(De resultaten van de gemaakte afbeelding verschijnen hier)

Sample result

FLUX 3 is gebouwd op Self-Flow, waardoor multimodale generatie en begrip efficiënt op één lijn worden gebracht binnen dezelfde architectuur, tegelijkertijd geschaald voor video, afbeeldingen en audio.

Waarom FLUX 3 de multimodale opwekking verandert

Eén model, één onderliggende realiteit

Afbeeldingen, video's en audio zijn projecties van dezelfde wereld, vastgelegd door verschillende sensoren. FLUX 3 leert van allemaal tegelijk, zodat geluid overeenkomt met impact, beweging gehoorzaamt aan massa en de toekomst volgt uit het verleden.

Self-Flow-architectuur

Self-Flow-architectuur

Op basis van Self-Flow heeft BFL de rekenkracht en data aanzienlijk geschaald om het genereren en begrijpen in hetzelfde onderliggende model te trainen, waardoor zowel de kwaliteit als de downstream-taakprestaties worden verbeterd.

Meng modaliteiten vrijelijk

FLUX 3 kan afbeeldingen en video met audio gezamenlijk genereren vanuit tekstprompts, of invoerreferenties zoals afbeeldingen en videoclips combineren om karakters, stijlen en context over te brengen naar nieuwe scènes.

Op weg naar visuele intelligentie

Op weg naar visuele intelligentie

FLUX 3 is een controlepunt in de missie van BFL om visuele intelligentie in de echte wereld te ontwikkelen: modellen die waarnemen, voorspellen en handelen in fysieke en digitale omgevingen.

Black Forest Labs introduceert FLUX 3-mogelijkheden in fasen, elk opgebouwd uit hetzelfde onderliggende multimodale flowmatching-model, met vroege toegang voor feedback en veiligheidstests.

FLUX 3 lanceringsplan

FLUX 3 is gebouwd voor makers, marketeers, ontwerpers, roboticateams en iedereen die een intelligente creatieve partner zoekt – niet slechts een converter met één modaliteit.

Voor wie is FLUX 3 bedoeld?

Makers en filmmakers

Genereer filmische clips met native audio, meertalige dialogen en stijldiversiteit – van openhartige camcorderbeelden tot animatie. Verbind clips tot langere multi-shotreeksen met consistente karakters.

Marketeers en visuele teams

Produceer campagneconcepten, gepolijste varianten en ontwerpen met veel typografie met een agentische redenering. Grondgeneraties in referenties en itereer sneller in beeld- en videoworkflows.

Fysieke AI en robotica

Fysieke AI en robotica

Gebruik het wereldbegrip van FLUX 3 voor actievoorspelling. FLUX-mimic verfijnt de video-backbone voor behendige manipulatie met beperkte taakspecifieke gegevens, waardoor contentcreatie en fysieke AI worden overbrugd.

De volgende ruggengraat van visuele intelligentie

Van interactieve beeld- en videobewerking tot simulatie, computergebruik en fysieke AI: FLUX 3 opent een brede grens. Het genereren van video's is vanaf vandaag beschikbaar in vroege toegang.

Eén uniform model drijft video, beeld en actie aan – elke modaliteit profiteert van gedeeld begrip van de wereld, getraind in afbeeldingen, video's en audio.

FLUX 3-mogelijkheden

Video met native audio (tot 20 seconden)

Tekst-naar-video, beeld-naar-video-animatie, video-naar-video-referentieoverdracht, generatieve video-audio-voortzetting en keyframe-naar-video-besturing - allemaal met gesynchroniseerde native audiogeneratie.

Meertalige dialoog en geluidsontwerp

Sterk in het vastleggen van menselijke gezichtsuitdrukkingen, het associëren van geluiden met fysieke gebeurtenissen en het genereren van meertalige dialogen, waarbij mogelijkheden worden gecombineerd tot sequenties van enkele minuten.

Stijldiversiteit en typografie

Handle varieert van openhartige camcorderbeelden tot animatie en filmbeelden. Sterke typografiegeneratie en geanimeerde ontwerpen in een breed scala aan visuele stijlen en beeldverhoudingen.

Agentische multi-shot-koppeling

Koppel afzonderlijke clips aan elkaar in langere reeksen met meerdere opnamen. Visuele referenties zorgen ervoor dat personages consistent blijven in alle scènes gedurende uitgebreide verhalen.

Beeldsynthese en bewerking

Synthetiseer en bewerk afbeeldingen in een breed scala aan stijlen, beeldverhoudingen en resoluties. Verbeterde naleving van complexe prompts en uiterst nauwkeurige tekstweergave in meerdere talen.

Actievoorspelling

Native actievoorspelling rechtstreeks geïntegreerd in FLUX 3, plus verfijnde gespecialiseerde modellen zoals FLUX-mimic – waarbij de voorgetrainde video-backbone wordt gebruikt als een dynamische basis.

Vroege benchmarkprestaties

In voorlopige 720p tekst-naar-video-evaluaties kreeg FLUX 3 de voorkeur boven verschillende toonaangevende modellen in onderlinge vergelijkingen – waarbij verdere verbeteringen werden verwacht tijdens vroege toegang.

Veelgestelde vragen over FLUX 3

Deze pagina vat de openbaar beschikbare informatie over FLUX 3 van Black Forest Labs samen. Wij zijn niet aangesloten bij BFL.