Gemma passeert 1 miljard downloads
3 mins read

Gemma passeert 1 miljard downloads

Google DeepMind meldde op 20 augustus dat zijn open modelfamilie Gemma de grens van een miljard downloads is gepasseerd. Het is voor het eerst dat het bedrijf een cumulatief adoptiecijfer noemt sinds Gemma begin 2024 verscheen. Ontwikkelaars publiceerden in diezelfde periode ruim 100.000 eigen varianten bovenop de open gewichten, schrijven Clement Farabet, vice-president bij Google DeepMind, en productdirecteur Olivier Lacombe in de aankondiging op blog.google.

Wat zo’n downloadcijfer waard is

Downloads zijn een rekbare maatstaf. Wie een model in tien containers trekt om een CI-pijplijn te testen, telt tien keer mee. Bovendien meet elke aanbieder net iets anders, iets wat eerder dit jaar zichtbaar werd toen Alibaba zijn Qwen-downloads ruimer telde dan Hugging Face zelf deed. Een miljard zegt daarom weinig over het aantal draaiende systemen. Het aantal varianten is interessanter: 100.000 gepubliceerde afgeleiden betekent dat mensen de gewichten daadwerkelijk verbouwen, quantiseren en hertrainen voor eigen werk.

Twee technici bekijken schermen in een satellietcontrolekamer bij schemering

Van poliklinieken tot een baan om de aarde

De toepassingen die Google noemt liggen ver van de chatbot. India’s National Health Authority verwerkte Gemma 4 in Aarogya Setu 2.0, een app met meer dan 100 miljoen Android-downloads, om medische rapporten om te zetten naar gestandaardiseerde digitale dossiers. Varianten uit de MedGemma-reeks draaien bij het All India Institute of Medical Sciences voor triage op de poli en bij gezondheidswerkers op het Ugandese platteland.

Opvallender is de ruimte. Volgens unite.ai zette NASA’s Jet Propulsion Laboratory dit jaar een tot 4 bit gecomprimeerde Gemma 3 4B op een satelliet van Loft Orbital. Dat systeem, NAVI-Orbital, classificeerde satellietbeelden met 88 procent nauwkeurigheid op een set van 7.960 opnamen. Satlyt en Starcloud draaien eveneens Gemma-modellen in een baan om de aarde, waar het versturen van ruwe beelden naar de grond duurder is dan ter plekke rekenen. Onderzoekers van Yale en Google bouwden met C2S-Scale een model op Gemma dat een nieuwe route voor kankertherapie aanwees, later bevestigd in levende cellen. En DolphinGemma, gemaakt met Georgia Tech en het Wild Dolphin Project, kauwt op reeksen dolfijngeluiden.

Waarom Google die gewichten weggeeft

Open gewichten zijn distributie. Wie de standaard levert voor kleine modellen die lokaal draaien, bepaalt straks welk ecosysteem eromheen ontstaat, en dat is precies waar concurrenten hun pijlen op richten. Meta duwt zijn agentmodel Muse Glimmer naar de pc van de gebruiker en AMD trainde Instella-MoE volledig op eigen GPU’s om te laten zien dat het zonder NVIDIA kan. Google ondersteunt de eigen kant van die strijd met een Kaggle-wedstrijd die ruim 1.600 inzendingen kreeg en met de GitHub-repository Awesome Gemma als officiële index van gemeenschapsprojecten.

Gemma is de kleine broer van Gemini, dat sinds kort onder leiding staat van Koray Kavukcuoglu. De gesloten modellen leveren de omzet, de open modellen leveren de gewenning.

Wat betekent dit

Voor Nederlandse organisaties die met gevoelige gegevens werken, is de kern van dit nieuws niet het ronde getal maar de bewijslast eronder. Ziekenhuizen in India, een satelliet van Loft Orbital en een laboratorium in New Haven draaien productiewerk op modellen die je zelf kunt downloaden, aanpassen en achter je eigen firewall houden. Dat verschuift de vraag bij een AI-project van welke API kies ik naar wat wil ik zelf beheren. Wie inkoopt, doet er goed aan die tweede vraag serieus te stellen voordat een contract met een cloudaanbieder de keuze voor jaren vastlegt.