Skip to content
AI-Feiten.nl

AI-Feiten.nl

Het laatste AI nieuws

site mode button
  • Home
  • Boeken
  • Grok
    • Grok 4 – uitleg & geschiedenis
    • Grok 3 – uitleg & geschiedenis
    • Grok 2 – uitleg & geschiedenis
    • Grok 1.5 – uitleg & geschiedenis
    • Grok 1 – uitleg & geschiedenis
  • Gemini
    • Gemini 3 – uitleg & geschiedenis
    • Gemini 2 – uitleg & geschiedenis
    • Gemini 1.5 – uitleg & geschiedenis
    • Gemini 1 – uitleg & geschiedenis
  • Claude
    • Opus 4.7
    • Opus 4.6 – uitleg & geschiedenis
    • Claude 4.5 Opus – uitleg & geschiedenis
    • Claude 4 Opus – uitleg & geschiedenis
    • Claude 3.5 Sonnet – uitleg & geschiedenis
    • Claude 3.5 Haiku – uitleg & geschiedenis
    • Claude 3 Sonnet – uitleg & geschiedenis
    • Claude 3 Opus – uitleg & geschiedenis
    • Claude 3 Haiku – uitleg & geschiedenis
    • Claude 2 – uitleg & geschiedenis
    • Claude 1 – uitleg & geschiedenis
  • ChatGPT
    • GPT-5.5 – uitleg & geschiedenis
    • GPT-5 – uitleg & geschiedenis
    • GPT-4o – uitleg & geschiedenis
    • GPT-4.5 – uitleg & geschiedenis
    • GPT-4 – uitleg & geschiedenis
    • GPT-3.5 – uitleg & geschiedenis
    • GPT-3 – uitleg & geschiedenis
    • GPT-2 – uitleg & geschiedenis
    • GPT 0.5 – uitleg & geschiedenis
  • Microsoft Copilot
    • Copilot voor Microsoft 365
    • Copilot in Edge – uitleg
    • Copilot in Windows – uitleg
    • Copilot Pro – uitleg

Benchmarks

Astra verdient drie keer zoveel als Fable op Vending-Bench
3 mins read

Astra verdient drie keer zoveel als Fable op Vending-Bench

  • Nieuws
13 september 2026 RedactieTagged AI-agents, Benchmarks, Claude Fable, GPT-6 Astra, Vending-Bench

GPT-6 Astra hield na een gesimuleerd jaar 15.515 dollar over op Vending-Bench, tegen 5.422 dollar voor Claude Fable 5.1. Het verschil zit in inkoop en in betalingen die nooit iets opleverden.

Read More
OpenHands 1.0 haalt 68 procent op SWE-bench Verified
3 mins read

OpenHands 1.0 haalt 68 procent op SWE-bench Verified

  • Nieuws
8 september 2026 RedactieTagged AI agents, Benchmarks, open source, softwareontwikkeling

De open-source codeagent OpenHands bereikt versie 1.0 met Docker-sandboxing, risicoanalyse per commando en ongeveer 68 procent op SWE-bench Verified.

Read More
Nemotron verslaat beste mens op programmeerolympiade
3 mins read

Nemotron verslaat beste mens op programmeerolympiade

  • Nieuws
4 september 2026 RedactieTagged Benchmarks, Nemotron, Nvidia, open weights, programmeren

NVIDIA’s Nemotron-3-Ultra-CC scoorde 535,4 van 600 punten op de Internationale Olympiade Informatica 2026 en bleef daarmee boven de beste menselijke deelnemer met 498,27.

Read More
OpenAI noemt GPT-6 Astra het begin van het AGI-tijdperk
3 mins read

OpenAI noemt GPT-6 Astra het begin van het AGI-tijdperk

  • Nieuws
4 september 2026 RedactieTagged AGI, ARC-AGI, Benchmarks, GPT-6, OpenAI

OpenAI lanceerde GPT-6 Astra en spreekt van het AGI-tijdperk. Wat het model kan, wat het kost en waarom het als eerste het stempel critical krijgt voor cyber.

Read More
Qwen-UI-Agent van Alibaba verslaat GPT-5.6 op telefoons
3 mins read

Qwen-UI-Agent van Alibaba verslaat GPT-5.6 op telefoons

  • Nieuws
24 augustus 2026 RedactieTagged AI agents, Alibaba, Benchmarks, open source, Qwen

Alibaba brengt Qwen-UI-Agent uit, een model dat schermen bedient op telefoon, pc en browser. Op mobiele benchmarks scoort het hoger dan GPT-5.6 Sol en Claude Opus 4.8.

Read More
Kennislaag Pinecone verslaat agents van OpenAI en Google
3 mins read

Kennislaag Pinecone verslaat agents van OpenAI en Google

  • Nieuws
23 augustus 2026 RedactieTagged AI-agents, Benchmarks, Enterprise AI, Pinecone, RAG

Een agent met Pinecone Nexus als kennislaag pakte de topscore op de τ-Knowledge-benchmark van Sierra, boven agents op modellen van OpenAI, Anthropic en Google.

Read More
Mysteriemodel Ox Alpha wijst volgens speurwerk naar Z.ai
3 mins read

Mysteriemodel Ox Alpha wijst volgens speurwerk naar Z.ai

  • Nieuws
22 augustus 2026 RedactieTagged Benchmarks, China AI, Open source AI, OpenRouter

Het anonieme model stealth/ox-alpha scoort 80 procent op DeepSWE en is gratis tot 27 augustus. Tokenizer- en video-analyses wijzen naar GLM-5.3 van Z.ai.

Read More
Qwen-UI-Agent van Alibaba bedient schermen beter dan GPT-5.6
2 mins read

Qwen-UI-Agent van Alibaba bedient schermen beter dan GPT-5.6

  • Nieuws
22 augustus 2026 RedactieTagged AI-agents, Alibaba, Benchmarks, Qwen

Alibaba’s Qwen-UI-Agent leest schermen en bedient telefoons en pc’s zelf. Op MobileWorld scoort het model 14,6 procentpunt boven Claude Opus 4.8, maar op de zware desktoptest OSWorld-v2 blijft het steken op 13,9 procent.

Read More
Kimi K3 verslaat Claude in blinde codetest
2 mins read

Kimi K3 verslaat Claude in blinde codetest

  • Nieuws
27 juli 202627 juli 2026 RedactieTagged Benchmarks, China, Kimi K3, Moonshot AI, Open source AI

Moonshot AI zette de open gewichten van Kimi K3 een dag te vroeg online. Het model van 2,8 biljoen parameters pakt de eerste plek op de Frontend Code Arena van LMArena, boven Claude Fable 5.

Read More
Claude Opus 5 pakt agentische benchmarks van Sol
2 mins read

Claude Opus 5 pakt agentische benchmarks van Sol

  • Nieuws
26 juli 2026 RedactieTagged Anthropic, Benchmarks, Claude Opus 5, GPT-5.6 Sol, OpenAI

Claude Opus 5 wint op Frontier-Bench en ARC-AGI-3, maar GPT-5.6 Sol houdt de leiding op TerminalBench. De cijfers en tarieven op een rij.

Read More

Berichten paginering

1 2 Volgende

Laatste nieuws

Grok 4.7 is goedkoop, maar blijft achter op codeertests
2 mins read

Grok 4.7 is goedkoop, maar blijft achter op codeertests

  • Nieuws
Redactie
Google splitst AX-runtime en zet taken in Redis
3 mins read

Google splitst AX-runtime en zet taken in Redis

  • Nieuws
Redactie
Z.ai maakt ZCode open source na upload van Git-historie
3 mins read

Z.ai maakt ZCode open source na upload van Git-historie

  • Nieuws
Redactie
Google verkoopt eigen laptops met Gemini
3 mins read

Google verkoopt eigen laptops met Gemini

  • Nieuws
Redactie
DeepSeek wil trainen op chips van Huawei
3 mins read

DeepSeek wil trainen op chips van Huawei

  • Nieuws
Redactie
  • ChatGPT
  • Claude
  • Gemini
  • Grok
  • Microsoft Copilot
  • Boeken
AI-Feiten - Het laatste nieuws over AI © 2026.