OpenAI koppelt ChatGPT-accounts aan surfgedrag elders
3 mins read

OpenAI koppelt ChatGPT-accounts aan surfgedrag elders

Onderzoekers van Buchodi Threat Intel publiceerden op 20 september een analyse van de advertentie-infrastructuur die OpenAI rond ChatGPT heeft opgetuigd. De kern: een cookie met de naam __obi, gezet door bzr.openai.com, die het ingelogde ChatGPT-account verbindt met gedrag op gewone websites. De bevindingen gingen op 14 september naar OpenAI, dat de melding bevestigde maar inhoudelijk nog niets zegt over de classificatie van de cookie.

Hoe de koppeling werkt

Het mechanisme is technisch niet exotisch. Terwijl een gebruiker op ChatGPT zit, wordt de accountidentificatie omgezet in een ondertekend JWT-token en naar bzr.openai.com/v1/obi/sync gestuurd. Daar wordt de __obi-cookie geplaatst op .openai.com, met een looptijd van een jaar en de instelling SameSite=None. Die laatste waarde is precies wat cross-site verzending mogelijk maakt. Bezoekt dezelfde browser daarna een webshop met de OpenAI-pixel, dan reist de cookie mee terug naar OpenAI.

Buchodi zag één identificatie terugkomen bij twaalf commerciele sites, waaronder Chewy, Wayfair, HelloFresh, Coursera en SeatGeek, verdeeld over dertien pixel-ID’s. Van 932 gedecodeerde tokens bleken er 736 aan een echt account gekoppeld; de rest bleef anoniem.

Voetganger kijkt op een smartphone langs een etalage in de stad

Wat de pixel meestuurt

De cookie is niet het enige dat vertrekt. De pixel leest ook velden van de pagina waar de bezoeker zich bevindt: e-mailadressen, telefoonnummers, postcodes en ingevulde formuliergegevens. Postcodes doken op in honderd events verspreid over 28 sites, en anders dan e-mail en telefoonnummer gaan die onversleuteld over de lijn. In het onderzochte verkeer woog automatisch geschraapte identiteit zwaarder dan wat adverteerders zelf aanleveren: 685 tegen 255 events. Bij 638 van de 881 zichtbare pixelconfiguraties stond automatische datakoppeling aan.

Het lastigste punt zit in de consentlaag. De cookie wordt gepresenteerd als analytics, maar doet het werk van een marketingtracker. Wie in een cookiebanner marketing weigert en analytics toestaat, krijgt de identificatie alsnog.

Waarom dit nu speelt

OpenAI bouwt in hoog tempo aan een advertentiebedrijf. Eind augustus ging in Europa de self-serve Ads Manager met CPC-biedingen open, en eerder deze maand verschenen de eerste tests met gesponsorde agents in ChatGPT. Een advertentiemodel vraagt om meetbaarheid, en meetbaarheid vraagt om identificatie. Dat OpenAI daarvoor naar hetzelfde gereedschap grijpt als Meta en Google is weinig verrassend, alleen is het onderliggende account hier gekoppeld aan gesprekken die mensen vaak persoonlijker voeren dan een zoekopdracht.

De timing helpt niet. Eerder kwam naar buiten dat OpenAI honderden mensen ChatGPT-chats liet lezen, en Europese toezichthouders zitten al scherp op AI-verwerkingen sinds Spanje het eerste datalek door een AI-agent registreerde.

Wie een AI-assistent gebruikt, denkt aan een gesprek, niet aan een advertentieprofiel. Bedrijven doen er goed aan nu al uit te zoeken welke pixels er op hun eigen site staan en wat die precies meesturen.

Leon Tindemans, AI-expert en Copilot- & ChatGPT-trainer, geeft onder meer ChatGPT-training aan organisaties.

Wat betekent dit

Voor gebruikers verandert er op korte termijn weinig zichtbaars, maar het beeld van ChatGPT als afgeschermde werkomgeving klopt minder goed dan veel mensen aannemen. Voor bedrijven die de OpenAI-pixel plaatsen ligt er een concreet risico: als de pixel ongevraagd formuliervelden meeleest, ben je zelf verwerkingsverantwoordelijke voor wat daar wegloopt. Een check op je tagmanager en een strakkere consentconfiguratie zijn dan geen overbodige luxe. En zolang OpenAI de classificatie van __obi niet toelicht, blijft de vraag open hoe een Europese toezichthouder hiernaar kijkt.