Direct naar de inhoud
ModelCompass powered by Wux AI
Terug naar overzicht
🇺🇸 xAI (Grok) · Verenigde Staten ZDR mogelijk #42 populair

Grok 4.20

Niveau: Professioneel Sterke allrounders met de beste balans tussen kwaliteit en prijs. Voor de meeste organisaties de slimste keuze.

Grok 4.20 is a reasoning model from SpaceXAI with industry-leading speed and agentic tool calling capabilities. It combines the lowest hallucination rate on the market with strict prompt adherance, delivering...

Uitgebracht: 31 mrt 2026 Contextvenster: 2M tokens Kennis tot: 2025-09-01
KostenLaag
SnelheidVlotinschatting
Werkgeheugen2M tokenshoeveel tekst het tegelijk aankan
SlimheidPrima58/100
Goede prijs-kwaliteit 30 waarde / 100

Loont de prijs?

Sterke balans tussen prijs en kwaliteit.

Bespaar slim: GPT-5.6 Luna (batch) is minstens net zo slim voor 86% minder geld. Bovendien is het minstens even goed in schrijven. Voor de meeste taken merk je het verschil nauwelijks.

Goed voor

  • E-mails, teksten en samenvattingen schrijven
  • Het verwerken van hele lange documenten
  • Het lezen van afbeeldingen en scans

Minder geschikt voor

  • Er zijn geen duidelijke beperkingen voor standaardgebruik
Aanbieder buiten de EU (Verenigde Staten & Canada). Let bij gevoelige gegevens op je verwerkersafspraken.
Zero Data Retention mogelijk. Dit model kan via OpenRouter worden ingezet bij een aanbieder die je invoer niet bewaart en niet gebruikt voor training — belangrijk voor vertrouwelijke bedrijfsgegevens. Stel ZDR in je OpenRouter-account in om dit af te dwingen.
Slimheid
58/100 · prima
Schrijven
77/100 · uitstekend
Programmeren
56/100 · prima
Agent-taken
69/100 · sterk
Geavanceerd — voor professionals

Onderstaande gegevens zijn bedoeld voor wie de techniek wil doorgronden: ruwe benchmarkscores, gemeten snelheid/latency, prijsopbouw en databronnen. Niet nodig om een goede keuze te maken.

Benchmarks

Klik op een benchmark voor uitleg en alle uitslagen per model; het ?-knopje geeft een korte uitleg.

Intelligence Index 38
Coding Index geen data
Math Index geen data
Agentic Index geen data
MMLU-Pro geen data
GPQA Diamond 91.1%
Humanity's Last Exam 34.5%
LiveCodeBench geen data
SciCode 45.6%
AIME (wiskunde) geen data
IFBench (instructievolgen) 81.2%
τ²-bench (agent-taken) 93%
Terminal-Bench (agent-taken) 37.9%

Prestaties (gemeten)

Output-snelheidgeen data
Time-to-first-token (latency)geen data
Snelheidsbroninschatting o.b.v. modelklasse

Design Arena (ELO)

Head-to-head ranglijst waarin modellen het tegen elkaar opnemen op praktijktaken (websites, code, UI, data­visualisatie). Hogere ELO = vaker gewonnen.

Gemiddelde ELO1230
htmlslidesELO 1180 · rang 12
asciiartELO 1205 · rang 20
webappsELO 1181 · rang 23
godotgamedevELO 1089 · rang 26

Technische specificaties

Model-IDx-ai/grok-4.20
Contextvenster2.000.000 tokens
Kennis bijgewerkt tot2025-09-01
Uitgebracht31 mrt 2026
Invoertekst, beeld, bestanden
Redeneren (reasoning)ja
Populariteitsscore70/100
Databronnenopenrouter, artificial_analysis, design_arena
Bekijk op OpenRouter