open source modellen
Xiaomi geeft MiMo-Flash en 7.000 RL-omgevingen vrij
Xiaomi zette MiMo-V2.6-Flash onder MIT-licentie op Hugging Face, samen met ruim 7.000 reinforcement-learningomgevingen. 309 miljard parameters, 15 miljard actief, context van een miljoen tokens.
Bonsai 2 perst Qwen3.8 27B terug tot 5,9 GB
PrismML comprimeert Qwen3.8 27B tot 5,9 GB met ternaire gewichten. Apache 2.0, draait op een laptop met 16 GB, 98,2 procent van de benchmarkscore blijft over.
Gemma passeert 1 miljard downloads
Google DeepMind meldt dat zijn open Gemma-modellen een miljard downloads haalden, met ruim 100.000 varianten van ontwikkelaars. Wat zegt dat cijfer echt?
Gemma 4 QAT maakt lokale AI lichter: nieuwe checkpoints mikken op ~1GB geheugen
Google brengt Gemma 4 QAT-checkpoints uit die quantization slimmer aanpakken. Resultaat: snellere, kleinere on-device modellen voor laptop en telefoon.
