Robotarmen werken aan een grijze auto op een geautomatiseerde fabriekslijn.
Nieuws24 juli · 02:224 min leestijd

Black Forest Labs brengt FLUX 3 uit voor beeld, video en robots

Black Forest Labs bracht FLUX 3 uit, één AI-model dat beeld, video met geluid en robotsturing gezamenlijk leert. Het draait al in tests op een lopende band van Audi en biedt de maakindustrie een niet-Amerikaans, niet-Chinees alternatief.

Black Forest Labs, een Duits AI-lab, bracht FLUX 3 uit: één model dat beeld, video met geluid én de aansturing van robots in dezelfde architectuur leert, en dat al op een productielijn van Audi wordt getest. Het lab is opgericht in augustus 2024 door oud-medewerkers van Stability AI die eerder Stable Diffusion bouwden.

Voor een Nederlandse machinebouwer of maakbedrijf dat zijn automatisering niet volledig aan één leverancier wil ophangen, komt er zo een fysieke-AI-optie bij die niet uit de Nvidia-hoek en niet uit een Chinees lab komt. De inzet is niet zomaar een demovideo: FLUX 3 stuurt in tests een robotarm aan die op de band van Audi flexibele deurrubbers plaatst, precies het soort buigzame materiaal waar starre automatisering op stukloopt.

Eén model, geen losse pijplijnen

Het verschil met veel bestaande systemen zit in de training. FLUX 3 leert beeld, video en audio gezamenlijk binnen één architectuur, op basis van wat het lab de Self-Flow-aanpak noemt, in plaats van losse modellen die achteraf aan elkaar geknoopt worden. Volgens oprichter Robin Rombach is dat de kern: een model dat alleen beeld leert, kan alleen beeld maken, terwijl video en actie het model laten begrijpen hoe de fysieke wereld zich gedraagt.

Officieel schema van Black Forest Labs: aparte encoders en decoders voor beeld, video, audio en actie voeden samen één gedeelde multimodale transformer. Bron: Black Forest Labs.
Officieel schema van Black Forest Labs: aparte encoders en decoders voor beeld, video, audio en actie voeden samen één gedeelde multimodale transformer. Bron: Black Forest Labs.

Dat gedeelde brein is uitbreidbaar met een vierde modaliteit: actie. Naast tekst, beeld, video en audio zit er een aparte encoder en decoder voor beweging in het model, waarmee FLUX 3 niet alleen pixels maar ook de handelingen van een robot voorspelt.

Van 20 seconden video tot een robotarm

Aan de mediakant genereert FLUX 3 video's van maximaal 20 seconden met ingebouwd, gesynchroniseerd geluid, een primeur voor het lab. In eigen voorkeurstests kreeg het model de voorkeur boven Luma Ray 3.2 in 93 procent en boven Runway Gen-4.5 in 77 procent van de vergelijkingen; tegen een sterkere concurrent als Kling v3 Pro zakt dat naar 60 procent. Die cijfers komen van het lab zelf, niet uit een onafhankelijke test.

De robotkant loopt via FLUX-mimic, gebouwd met een gespecialiseerd roboticabedrijf. Bij Audi plaatst dat systeem flexibele deurrubbers met een reactietijd van ongeveer 101 milliseconden, zacht materiaal dat conventionele automatisering nauwelijks aankon. Het is nog een test op echte productietaken, geen volledige uitrol, maar het tilt de belofte boven de demofase uit.

Een Europees alternatief op de fabrieksvloer

De timing plaatst FLUX 3 in een druk veld. Nvidia bracht kort geleden Cosmos 3 Edge uit en bond meteen Japanse industriereuzen als Fanuc, Kawasaki en SoftBank aan zijn physical-AI-stack, terwijl Alibaba met zijn Qwen-Robot-suite die machines handen, voeten en een brein geeft dezelfde beweging vanuit China maakt. Voor een maakbedrijf dat de perceptie en besturing van zijn machines niet aan één ecosysteem wil vastklinken, is een Duitse aanbieder een reële verbreding van de keuze.

Beschikbaar is het nog beperkt. De videofunctie zit in early access, beeldgeneratie volgt de komende weken, en de actievoorspelling loopt voorlopig alleen via geselecteerde partners. Een open-gewicht versie, FLUX 3 Dev, staat later dit jaar op de planning; prijzen noemt het lab nog niet.

Wat deze release vooral laat zien, is dat fysieke AI, modellen die niet alleen praten maar ook kijken en handelen, geen exclusief terrein meer is van Nvidia of de grote Chinese labs. Het onderwerp verschuift van de vraag of een model een robot kan aansturen naar de vraag van wie je die laag betrekt en hoe makkelijk je er weer los van komt. Voor wie automatisering op de werkvloer plant, wordt de keuze voor een AI-leverancier daarmee net zo strategisch als de keuze voor de machines zelf.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Automatisering zonder lock-in

Ik denk met je mee welke AI en automatisering echt bij je proces passen, ontwerp de oplossing en bouw hem end-to-end, self-hosted waar dat kan, zodat je niet aan één leverancier vastzit.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Nvidia lanceert Cosmos 3 Edge en bindt Japanse industrie aan zijn robotstack
Nieuws
4 min

16 jul 14:12

Nvidia lanceert Cosmos 3 Edge en bindt Japanse industrie aan zijn robotstack

Nvidia lanceerde Cosmos 3 Edge, een model dat robots op een lokale computer laat zien en handelen, en bond Japanse industriereuzen als Fanuc, Kawasaki en SoftBank aan zijn physical-AI-stack. Voor de industrie een kans en een lock-in-vraag tegelijk.

World Labs brengt wereldmodel Atlas uit voor 3D-scenes uit een paar foto's
Nieuws
5

2 sep 16:38

World Labs brengt wereldmodel Atlas uit voor 3D-scenes uit een paar foto's

World Labs brengt Atlas uit, een wereldmodel dat uit een handvol foto's een 3D-ruimte reconstrueert en exporteert als Gaussian splat. Het model draait in early access; het publiek beschikbare Marble gaat er later op draaien.

Japan en Nvidia bouwen 's werelds eerste nationale AI-fabriek
Nieuws
5 min

17 jul 02:26

Japan en Nvidia bouwen 's werelds eerste nationale AI-fabriek

Japan verklaart als eerste land een AI-rekencluster tot nationale infrastructuur: een fabriek van 27.500 Nvidia-GPU's, 140 megawatt en tot 6,2 miljard dollar overheidsgeld. Soevereine rekenkracht, gebouwd op Amerikaans silicium.

Black Forest Labs stelt FLUX 3 Video algemeen beschikbaar vanaf 6 dollarcent per seconde
Nieuws
4 min

5 aug 16:22

Black Forest Labs stelt FLUX 3 Video algemeen beschikbaar vanaf 6 dollarcent per seconde

Black Forest Labs haalt FLUX 3 Video uit early access. Clips tot twintig seconden met lipsynchrone dialoog kosten vanaf 6 dollarcent per seconde, en het lab publiceert voor het eerst tarieven per resolutie.

Red Hat maakt AI 3.5 klaar voor beheerde productie
Nieuws
3 min

10 sep 10:57

Red Hat maakt AI 3.5 klaar voor beheerde productie

Red Hat AI 3.5 maakt EvalHub, multi-tenancy, agentbeveiliging en observability algemeen beschikbaar. Voor Nederlandse organisaties verschuift de beheeropgave daarmee van een model kiezen naar vooraf testen, bevoegdheden afbakenen en verbruik aantonen.

Gesanctioneerd Inspur blijft Nvidia-topchips krijgen via Amerikaanse dochter
Nieuws
4

6 sep 12:07

Gesanctioneerd Inspur blijft Nvidia-topchips krijgen via Amerikaanse dochter

Inspur staat sinds maart 2023 op de Amerikaanse Entity List en bleef via zijn Amerikaanse dochter Aivres Nvidia-topchips ontvangen. De regel die dat gat moest dichten ligt stil tot 10 november 2026.