FLUX 3 Video maakt complete AI-video’s met beeld, stemmen en geluid

FLUX 3 Video maakt complete AI-video’s met beeld, stemmen en geluid

Black Forest Labs brengt zijn nieuwe videogenerator breed beschikbaar

De strijd om de beste AI-videogenerator krijgt er een stevige uitdager bij. Black Forest Labs heeft FLUX 3 Video algemeen beschikbaar gemaakt, een nieuw generatief model dat vanuit tekst en afbeeldingen videoclips van maximaal twintig seconden kan produceren. Daarbij worden niet alleen de beelden gegenereerd: ook dialogen, geluidseffecten en omgevingsgeluiden ontstaan rechtstreeks binnen hetzelfde proces.

De eerste versie is beschikbaar via de API van Black Forest Labs en een aantal geselecteerde partners. Video's kunnen worden gemaakt in HD-resolutie van 720p, terwijl Full HD-uitvoer van 1080p via upscaling mogelijk is.

FLUX 3 Video, Part 1: Generation

FLUX 3 Video, Part 1: Generation

https://bfl.ai

Niet alleen mooie beelden, maar een model van de werkelijkheid

Achter FLUX 3 zit een bredere ambitie dan simpelweg het produceren van spectaculaire AI-video's. Black Forest Labs beschouwt video, beeld en geluid als verschillende manieren waarop dezelfde werkelijkheid wordt waargenomen.

Daarom werd FLUX 3 vanaf de basis multimodaal ontwikkeld. Het model moet niet alleen begrijpen hoe een scène eruitziet, maar ook hoe voorwerpen bewegen, hoe gebeurtenissen elkaar opvolgen en welk geluid daarbij hoort.

Dat vertaalt zich volgens de ontwikkelaar in een opvallend brede visuele stijl. FLUX 3 hoeft niet automatisch alles om te zetten in de typische gepolijste, filmische AI-esthetiek. Het model kan evengoed beelden produceren die spontaan, nostalgisch, speels, rauw of bewust vreemd ogen.

Van enkele woorden naar een complete scène

Een gebruiker kan simpelweg beschrijven wat er moet gebeuren, waarna FLUX 3 Video beweging, compositie en geluid samen opbouwt. Ook complexere opdrachten worden ondersteund.

Daarnaast kan een bestaande afbeelding als vertrekpunt dienen. Met keyframes kunnen specifieke momenten worden vastgelegd, waarna het model de tussenliggende beweging genereert. Binnen één clip kunnen bovendien meerdere scènes en camerastandpunten voorkomen zonder dat de samenhang volledig verloren hoeft te gaan.

Een andere interessante mogelijkheid is video continuation. Daarbij krijgt het model maximaal vier seconden bestaande video mét geluid als input. FLUX 3 probeert vervolgens de beweging, cameravoering, dialoog en audio logisch voort te zetten.

Stemmen en geluid worden onderdeel van de generatie

Voor makers kan vooral de geïntegreerde audiogeneratie belangrijk worden. Waar beeld en geluid traditioneel in verschillende productiestappen ontstaan, probeert FLUX 3 beide tegelijk te genereren.

Personages kunnen spreken, terwijl lipbewegingen op de dialoog worden afgestemd. Daarnaast genereert het systeem geluidseffecten en achtergrondgeluiden die bij de gebeurtenissen in beeld passen.

Ook meertaligheid speelt een belangrijke rol. Onder meer Engels, Chinees, Spaans, Frans, Duits, Japans, Portugees, Russisch, Italiaans, Indonesisch, Turks, Hindi en Punjabi worden ondersteund. Daarmee mikt Black Forest Labs nadrukkelijk op toepassingen die verder gaan dan uitsluitend Engelstalige AI-content.

Eerst goedkoop experimenteren, daarna renderen

Een praktisch onderdeel van FLUX 3 Video is de zogenaamde Draft Mode. Daarmee kunnen makers snel een goedkopere voorvertoning van hun idee genereren.

Pas wanneer de compositie, onderwerpen en beweging bevallen, hoeft de video op volledige kwaliteit te worden gerenderd. Het uiteindelijke resultaat blijft daarbij gebaseerd op dezelfde opzet als de goedgekeurde conceptversie.

Dat lijkt misschien een klein detail, maar kan voor professionele workflows belangrijk zijn. Generatieve video vraagt relatief veel rekenkracht en experimenteren met tientallen volledige renders kan daardoor snel duur worden. Een conceptfase maakt itereren efficiënter.

Black Forest Labs claimt sterke prestaties tegenover concurrenten

Black Forest Labs positioneert FLUX 3 meteen tussen de sterkste videogeneratoren van dit moment. Volgens interne evaluaties met menselijke beoordelaars presteert het model bijzonder sterk bij zowel tekst-naar-video als afbeelding-naar-video.

Bij tekst-naar-video zou FLUX 3 volgens het bedrijf een duidelijke voorsprong behalen in zijn interne vergelijking. Bij afbeelding-naar-video zou het model ongeveer gelijk eindigen met Seedance 2.0 en andere geteste modellen voorbijstreven.

Zoals bij vrijwel alle benchmarks die door een ontwikkelaar zelf worden gepubliceerd, blijven onafhankelijke vergelijkingen belangrijk om te bepalen hoe groot die voorsprong in de praktijk werkelijk is.

AI-video schuift richting complete productieomgeving

De introductie laat vooral zien hoe snel generatieve video evolueert. De eerste generatie systemen draaide voornamelijk om het animeren van korte scènes. Nieuwere modellen proberen steeds meer onderdelen van een traditionele productie samen te brengen: camerabeweging, montage, stemmen, geluidseffecten, lip-sync en visuele continuïteit.

Daarmee verandert ook de rol van de prompt. Die wordt steeds minder een eenvoudige beschrijving van één beeld en steeds meer een soort digitale regieaanwijzing.

Voor reclame, sociale media, conceptontwikkeling, educatieve video's en korte documentaires kan dat de drempel voor videoproductie aanzienlijk verlagen.


FLUX 3 moet uiteindelijk veel meer dan video kunnen maken

Video is bovendien slechts één onderdeel van de plannen rond FLUX 3. Black Forest Labs werkt aan uitgebreidere controle waarbij combinaties van afbeeldingen, video en audio als referentiemateriaal kunnen worden gebruikt.

Daarnaast staan FLUX 3 Image voor beeldgeneratie en -bewerking en FLUX 3 Dev als open-weightvariant op de roadmap. Daarmee wordt duidelijk dat Black Forest Labs FLUX 3 niet simpelweg als een nieuwe videogenerator ziet. Het bedrijf probeert één multimodale basis te bouwen die beelden, video, geluid en uiteindelijk zelfs acties kan begrijpen en voorspellen.

De grens tussen een AI-model dat een video kan maken en een model dat begrijpt hoe de zichtbare wereld zich gedraagt, begint daardoor langzaam te vervagen.

Aanbevolen voor jou

In de kijker

AI kan vanaf nu de muis overnemen op je scherm

AI kan vanaf nu de muis overnemen op je scherm

Meta zet de volgende stap in AI met AI-gegenereerde posts

Meta zet de volgende stap in AI met AI-gegenereerde posts

Salesforce presenteert Agentforce – Zoals AI voor Sales bedoeld is

Salesforce presenteert Agentforce – Zoals AI voor Sales bedoeld is

Google Earth laat gebruikers binnenkort ‘tijdreizen’ tot wel 80 jaar terug

Google Earth laat gebruikers binnenkort ‘tijdreizen’ tot wel 80 jaar terug

Updates

Inschrijven Nieuwsbrief

Zo word je altijd als eerste op de hoogte gebracht van ons laatste nieuws, updates, jobs, tips & promoties. Stay UP-TO-DATE!

WEBSITE LATEN MAKEN?​​​​​​​​​​​​​​

Kies voor een UP-TO-DATE AI Website 100% in Google

Een UP-TO-DATE AI Website maakt het gemakkelijk om automatisch up-to-date te blijven met je klanten en overal aanwezig te zijn.

Maak een afspraak