FLUX 3 stuurt nu ook robots bij Audi
Black Forest Labs presenteerde deze week niet alleen FLUX 3 voor beeld, video en geluid, maar liet meteen zien dat hetzelfde model ook robots kan aansturen. Samen met het Zwitserse mimic robotics maakte de Duitse studio FLUX-mimic, een model dat robotarmen laat handelen. Het draait al op de fabrieksvloer bij Audi.
De aankondiging kwam vlak na de lancering van FLUX 3 zelf en verschoof de aandacht van contentmakers naar de industrie. Volgens Black Forest Labs (bfl.ai) draait beeldgeneratie en robotbesturing op dezelfde onderliggende weights.
Van videovoorspelling naar robothandeling
De redenering achter FLUX-mimic is nuchter. Een model dat leert voorspellen hoe een scene er een fractie later uitziet, leert impliciet ook hoe een fysieke handeling zich een moment later ontvouwt. Video voorspellen en een handeling voorspellen zijn dan bijna dezelfde taak, met een ander soort uitvoer. Black Forest Labs bouwt op die aanname voort: de FLUX 3-backbone die videobeelden genereert, koppelt mimic aan zijn eigen kennis van robotleren voor fijne, precieze manipulatie.
Bij Audi test de autobouwer het model op werk dat klassieke automatisering lastig vindt, zoals het aanbrengen van flexibele deurrubbers. Dat soort taken vraagt om aanpassen aan materiaal dat meegeeft en vervormt. Volgens the-decoder.com reageert het volledige systeem in ongeveer 101 milliseconden, dicht bij de snelheid van een menselijke visuele reflex.

30 minuten data in plaats van 30 uur
Het meest concrete verschil zit in de hoeveelheid trainingsdata. Afhankelijk van de moeilijkheid van een taak laat het model zich bijstellen met ongeveer 30 minuten robotdata, waar eerdere aanpakken 30 uur of meer nodig hadden. Dat verkort de weg van een nieuwe handeling naar een werkende robot flink, en dat is precies waar veel fabrieken op vastlopen: elke nieuwe klus vergt nu een lange, dure trainingsronde.
Die datahonger is al langer het knelpunt in de robotica. Investeerders steken er fors geld in, zoals blijkt uit de financieringsronde van Genesis AI en de stap van Blackstone bij robotmaker Futronic. Een model dat met minder data toe kan, raakt de kern van dat probleem.
Beeld en beweging op één fundament
De stelling van Black Forest Labs is dat fysieke AI en contentgeneratie op hetzelfde fundament draaien. Datzelfde idee zie je terug bij andere partijen die aan robotbesturing werken, van experimenten met robots die op hersensignalen reageren tot de zware inzet op reken- en inferentiecapaciteit die dit soort modellen nodig heeft. FLUX 3 Video zit nu in gated early access, de beeldversie volgt over enkele weken en een open-weight Dev-variant staat later dit jaar op de planning. De robot- en action-onderdelen blijven voorlopig achter API’s en partnertoegang.
Black Forest Labs benadrukt zelf dat de vergelijkingscijfers voorlopig zijn en nog niet onafhankelijk zijn getoetst. De Audi-inzet is een test, geen brede uitrol.
Wat betekent dit
Als een videomodel met een halfuur data een robot kan bijscholen, verschuift de rem in de fabrieksrobotica van hardware naar software. De arm hoeft niet slimmer, het model dat hem stuurt moet sneller leren. FLUX-mimic bij Audi is daarvan een vroeg, concreet voorbeeld, geen eindpunt. Wie robots inzet, doet er goed aan te volgen of dit soort modellen buiten de demo standhoudt, want daar zit het echte verschil tussen belofte en productie.
