Google geeft Gemini 3.8 Live een pratend gezicht
3 mins read

Google geeft Gemini 3.8 Live een pratend gezicht

Google heeft Gemini 3.8 Live met Live Avatar algemeen beschikbaar gemaakt in Gemini Enterprise. De chatbot krijgt daarmee een gezicht: een geanimeerde gesprekspartner die in bijna realtime praat, meekijkt en de lipbewegingen laat kloppen met wat er gezegd wordt. Google kondigde de functie op 24 september aan op zijn eigen blog, na een demo eerder dit jaar op Cloud Next.

Wat Live Avatar precies doet

Volgens de aankondiging verwerkt het model beeld en geluid tegelijk en antwoordt het met stem en video in bijna realtime. De avatar past gezichtsuitdrukking en lipsynchronisatie aan, ook als het gesprek halverwege van taal wisselt. Google noemt 97 ondersteunde talen en zegt dat de videokwaliteit daarbij niet inzakt.

Technisch zit er een detail in dat voor callcenters uitmaakt: asynchrone tool calls. De avatar kan op de achtergrond een systeem bevragen of data ophalen zonder het gesprek stil te leggen. Wie weleens tien seconden stilte heeft gehoord terwijl een spraakbot iets opzocht, weet waarom dat telt. Dezelfde beweging zag je eerder bij ChatGPT Voice, dat toegang kreeg tot mail en agenda.

Klantenservicemedewerker met headset in een open kantoor

Eigen gezicht, met een slot erop

Naast een bibliotheek met kant-en-klare avatars kunnen organisaties een eigen figuur maken vanaf een referentiefoto. Google zegt dat de gelijkenis, huisstijl en karakteruitstraling daarbij behouden blijven. Die optie zit voorlopig achter een allowlist voor zakelijke klanten, schrijft Google, wat logisch is: een systeem dat van een foto een pratend gezicht maakt, is ook het recept voor een deepfake.

Alle gegenereerde audio en video krijgt een SynthID-watermerk, het onzichtbare label waarmee Google AI-materiaal herkenbaar wil houden. Of dat in de praktijk standhoudt bij doorsturen en hercomprimeren, is een andere vraag. Platformen kiezen intussen voor zichtbare labels, zoals het AI creator-label van Instagram.

Waarom Google hier nu op inzet

Avatars waren tot nu toe het terrein van gespecialiseerde aanbieders zoals HeyGen en Synthesia. Door de functie in Gemini Enterprise te zetten, verkoopt Google het als onderdeel van een pakket dat klanten toch al afnemen. Het past in het tempo dat Google zichzelf oplegt: DeepMind-baas Koray Kavukcuoglu zei deze week dat Gemini 4 al in post-training zit en dat het bedrijf sneller wil leveren.

De vraag is wie erop zit te wachten. Een pratend hoofd voegt niets toe aan een supportgesprek dat ook via tekst kan. Bij training, intake en rondleidingen ligt dat anders, en daar zoeken bedrijven die de interface aan AI-agenten overlaten nu naar vorm.

Wat betekent dit

Voor Nederlandse organisaties is dit vooral een signaal dat videobellen met een AI geen experiment meer is maar een aan te zetten functie. Wie ermee aan de slag wil, zou moeten beginnen bij de spelregels en niet bij de techniek: wanneer maak je kenbaar dat de gesprekspartner geen mens is, wie mag een bedrijfsavatar laten maken, en wat gebeurt er met de opnames. Onder de AI Act moeten gebruikers weten dat ze met een systeem praten. Een gezicht dat overtuigend terugkijkt, maakt die plicht eerder zwaarder dan lichter.