AI-inferentie
TypeSafe laat Jev beslissen in plaats van praten
TypeSafe AI lanceert Jev, een model dat getypeerde beslissingen met kansen teruggeeft in plaats van tekst. 70 tot 500 milliseconden, 0,042 dollar per miljoen invoertokens, maar de cijfers komen van de leverancier zelf.
Qualcomm gaat AI-inferentiechips maken voor AWS
Qualcomm en Amazon tekenen een meerjarige deal voor op maat gemaakte AI-inferentiechips en optische verbindingen in AWS-datacenters. Amazon krijgt een warrant op 25 miljoen Qualcomm-aandelen.
OpenAI meet eigen chip Jalapeño af tegen Nvidia
OpenAI publiceert de eerste benchmarks van zijn Jalapeño-inferentiechip: tot 1,9 keer meer werk per watt dan Nvidia Blackwell. De metingen komen wel uit eigen huis.
Nvidia zet inferentiechip Groq 3 LPX in productie
Nvidia meldt op Hot Chips 2026 dat inferentieversneller Groq 3 LPX in volle productie is: 256 versnellers per rack en 3.400 tokens per seconde bij 100.000 tokens context. Nebius is de eerste afnemer.
OpenAI-chip Jalapeño verslaat Nvidia op stroomverbruik
OpenAI publiceert de eerste benchmarks van Jalapeño, de inferentiechip met Broadcom: 1,5 tot 1,9 keer meer werk per watt en fors lagere latency dan Nvidia’s GB200 en GB300.
Chipstartup Etched verdubbelt waardering naar 21 miljard
Chipstartup Etched ziet zijn waardering in een maand tijd verdubbelen naar 21 miljard dollar, gedreven door de vraag naar snellere en goedkopere AI-inferentie.
OpenAI zet GPT-5.6 Sol op 750 tokens per seconde
OpenAI geeft een preview van Ultrafast: GPT-5.6 Sol tot 14 keer sneller via Cerebras-chips, met 750 tokens per seconde. Wat het betekent voor AI-agents.
Anthropic wil Decart kopen voor 6 miljard dollar
Anthropic onderhandelt volgens Bloomberg over de overname van het Israëlische Decart voor circa 6 miljard dollar, vlak voor de geplande beursgang.
OLIX haalt 312 miljoen op voor optische AI-chips
Het Britse OLIX haalde 312 miljoen dollar op bij een waardering van 3,3 miljard. De DX-1-chip gebruikt optische verbindingen en on-chip SRAM in plaats van HBM.
HBF krijgt eerste open standaard voor AI-geheugen
Sandisk en SK hynix publiceren via het Open Compute Project de eerste specificatie voor High Bandwidth Flash: tot 512 GB per stapel en 3 TB/s, bedoeld om het geheugenknelpunt bij AI-inferentie op te lossen.
