Reflection AI toont Beam, open model met 501 miljard parameters
Het Amerikaanse Reflection AI heeft Beam gepresenteerd, een taalmodel met 501 miljard parameters dat het later deze maand als open-weight model vrijgeeft. Het bedrijf richt zich met Beam op programmeerwerk en AI-agents en zet het model openlijk neer als Amerikaans antwoord op de sterke open modellen uit China.
Groot model, kleine actieve kern
Beam is een sparse mixture-of-experts-model. Van de 501 miljard parameters zijn er per token maar 23 miljard actief, meldt Crypto Briefing. Het basismodel is getraind op 23,8 biljoen tokens uit het openbare web en commerciële bronnen, met veel softwarecode. Volgens SiliconANGLE filterde Reflection die code per programmeertaal om zwakke bestanden eruit te halen.
Daarna volgde een reinforcement-learningfase van vier weken. Reflection zette daarvoor ruim tienduizend Nvidia GB300-chips in en draaide 1,3 miljard virtuele sandboxes waarin het model code schreef, op het web zocht en agenttaken uitvoerde. Voor die hardware sloot Reflection eerder een compute-deal met SpaceX, volgens SiliconANGLE goed voor 6,3 miljard dollar aan GB300-systemen.

Wat de benchmarks zeggen
De cijfers komen voorlopig alleen van Reflection zelf. Beam scoort 80,9 procent op SWE-Bench Verified, een test waarbij een model echte bugs in open-sourceprojecten moet oplossen, en 80,1 op Terminal Bench v2.1. Reflection vergelijkt Beam met het Chinese GLM-5.2, dat zo’n 250 miljard parameters meer heeft. Beam zou sommige taken beter doen met een derde tot een kwart van de hardware.
Niet overal wint Beam. Op DeepSWE v1.1 haalt het 44,4 procent, tegen 68,0 voor Kimi K3 en 74,2 voor DeepSeek V4.1 Flash, blijkt uit een overzicht van byteiota. Op Humanity’s Last Exam zonder hulpmiddelen blijft Beam steken op 36,2 procent. SiliconANGLE merkt op dat het model ook achterloopt op gesloten topmodellen zoals Claude Fable 5.1. Een technisch rapport is er nog niet, dus onafhankelijke tests moeten wachten tot de gewichten online staan. Dat zelfgerapporteerde scores op echte bedrijfscode anders kunnen uitvallen, liet de REAL-SWE-benchmark eerder al zien.
Apache 2.0 en de concurrentie met China
Reflection brengt de gewichten uit onder Apache 2.0. Bedrijven mogen het model dan commercieel gebruiken, aanpassen en zelf hosten zonder licentiekosten. Tot de release is Beam alleen via een early-accessprogramma te gebruiken.
Die licentie is het eigenlijke verkoopargument. Veel westerse organisaties mogen om compliance-redenen geen Chinese open modellen draaien, terwijl partijen als DeepSeek en Z.ai met zijn GLM-modellen dat segment juist domineren. Reflection werd in maart 2024 opgericht door de oud-DeepMind-onderzoekers Misha Laskin en Ioannis Antonoglou, haalde meer dan 4 miljard dollar op en heeft Nvidia, Sequoia en Citigroup als investeerders.
Wat betekent dit
Voor Europese bedrijven die een groot model in eigen beheer willen draaien, komt er een Amerikaanse optie met een ruime licentie bij. Kort geleden kondigde het Duitse Aleph Alpha al het open model Kolibri aan. De kritiek is er ook: een veelgelezen reactie op Hacker News stelde dat Beam groter en duurder is dan DeepSeek V4.1 Flash en op de gemeten benchmarks slechter scoort. Of Beam meer is dan een politiek aantrekkelijk alternatief, blijkt pas als ontwikkelaars de gewichten zelf kunnen testen.
