OpenAI lanceert GPT-Live: praten en luisteren tegelijk
2 mins read

OpenAI lanceert GPT-Live: praten en luisteren tegelijk

OpenAI heeft op 8 juli GPT-Live uitgebracht, een nieuwe generatie spraakmodellen voor ChatGPT die tegelijk kan luisteren en praten. Het bedrijf rolt de techniek vanaf vandaag wereldwijd uit, meldt TechCrunch. Het gaat om twee modellen: GPT-Live-1 en het lichtere GPT-Live-1 mini.

Wat full-duplex verandert

De oude Advanced Voice Mode werkte in beurten. Je sprak, het model wachtte tot je klaar was en antwoordde daarna. GPT-Live gebruikt een full-duplex-architectuur en verwerkt inkomend geluid terwijl het zelf praat. Volgens OpenAI neemt het model daardoor vele keren per seconde een beslissing: doorpraten, luisteren, pauzeren, onderbreken of een tool aanroepen. In een gesprek laat het merken dat het meeluistert met korte tussenwerpsels als “mhmm” of “yeah”, en het blijft stil als je even wilt nadenken.

Die aanpak verschilt van de realtime-spraakmodellen die OpenAI eerder deze week voor ontwikkelaars uitbracht. Die richten zich op stemagents in de API, terwijl GPT-Live vooral de gesproken interface van de ChatGPT-app zelf vervangt.

Zwaar denkwerk gaat naar GPT-5.5

GPT-Live is gebouwd voor snelle, natuurlijke conversatie, niet voor diep redeneren. Voor vragen die websearch, langere gedachtegangen of complexer werk vergen, delegeert het model op de achtergrond naar een krachtiger model. Bij de lancering is dat GPT-5.5. Het antwoord komt terug in het gesprek zodra het klaar is, zonder dat je van modus hoeft te wisselen.

De verdeling tussen de twee versies is duidelijk. GPT-Live-1 mini vervangt standaard de Advanced Voice Mode voor alle gebruikers. Het grotere GPT-Live-1 is er voor de betalende abonnees. Dat sluit aan bij de bredere modelstrategie die OpenAI hanteert rond de recente brede lancering van GPT-5.6.

Wat kan het model al

OpenAI noemt natuurlijke wisselingen van spreekbeurt, onderbrekingen door de gebruiker en live vertaling. Atty Eleti, productlead voor ChatGPT Voice, zei tegen TechCrunch dat het team stem op termijn ziet als een primaire interface voor computers en voor het aansturen van langlopend agentwerk. In tests hield het systeem gesprekken van 30 tot 40 minuten vol. Perfect is het niet: bij een demo van live vertaling klonk het Hindi met een onnatuurlijk accent, en OpenAI zegt dat het model is geoptimaliseerd voor de “meest gesproken talen” zonder die precies te benoemen.

Wat betekent dit

Spraak wordt zo een serieuzere manier om met AI te werken in plaats van een tekst-alternatief. Voor wie ChatGPT dagelijks gebruikt, betekent full-duplex minder ongemakkelijke stiltes en gesprekken die dichter bij een echt telefoontje liggen. De echte test volgt in de praktijk: hoe goed het model onderbrekingen en achtergrondgeluid aankan buiten een demo. De timing past in een drukke week voor AI-bedrijven, met ook Anthropic dat Claude Fable 5 wereldwijd herstelde en nieuwe discussies over toegang van AI-crawlers tot het web.