lokale AI
Bonsai 2 perst Qwen3.8 27B terug tot 5,9 GB
PrismML comprimeert Qwen3.8 27B tot 5,9 GB met ternaire gewichten. Apache 2.0, draait op een laptop met 16 GB, 98,2 procent van de benchmarkscore blijft over.
Edge0 draait 35B-model vanaf SSD in 3 GB geheugen
AutoArk laat met Edge0 een mixture-of-experts-model van 35 miljard parameters draaien in 2,9 GB werkgeheugen, door experts rechtstreeks van SSD te streamen.
Perplexity draait AI-agent lokaal op RTX-pc’s
Perplexity brengt zijn agent Portable Computer naar Windows, volledig lokaal op NVIDIA RTX-kaarten met minstens 24 GB videogeheugen. Gevoelige bestanden blijven op de eigen pc.
AMD zet AI-workstation met 576 GB HBM3E op je bureau
AMD toonde op IFA de Threadripper Halo Station: 96 kernen, tot vier MI350P-versnellers en 576 GB HBM3E om modellen van duizend miljard parameters lokaal te draaien. Levering pas in 2027.
NVIDIA koppelt je thuis-pc’s tot één AI-cluster
NVIDIA brengt PAIR uit, gratis open source software die AI-taken verdeelt over meerdere pc’s in het thuisnetwerk. In een demo zakte een agenttaak van 18 naar bijna 9 minuten.
MindBase van Anker draait AI in huis, niet in de cloud
Anker toont op IFA 2026 de MindBase, een thuishub met een eigen taalmodel van 26 TOPS die camerabeelden lokaal beoordeelt en tot 48 TB opslaat.
Perplexity houdt gevoelige data op de Mac
Perplexity’s Computer-agent begint in de cloud en schuift gevoelige stappen naar een lokaal model op de Mac. Een classifier van 0,6 miljard parameters bewaakt de grens.
Meta zet agentmodel Muse Glimmer op je eigen pc
Meta brengt Muse Glimmer uit: een agentmodel van 30 miljard parameters onder Apache 2.0 dat lokaal draait op een videokaart met 24 GB geheugen.
GLM-5.2 draait op een laptop met 25GB RAM
Een klein C-programma genaamd Colibri laat het Chinese GLM-5.2 met 744 miljard parameters draaien op een gewone laptop met 25GB RAM, zonder videokaart. Traag, maar het werkt.
CyberSecQwen-4B laat zien waarom ‘kleine’ cybermodellen juist nu interessant zijn
CyberSecQwen-4B toont een trend: kleine, specialistische cybersecurity-modellen die lokaal draaien. Wat betekent dit voor SOC-teams, governance en kosten?
