Terug naar overzicht
🇺🇸 OpenAI · Verenigde Staten Geen ZDR
o3
Niveau: Standaard
Ruim voldoende voor de meeste dagelijkse taken, en een stuk voordeliger dan de topklasse.
o3 is a well-rounded and powerful model across domains. It sets a new standard for math, science, coding, and visual reasoning tasks. It also excels at technical writing and instruction-following....
KostenGemiddeld
SnelheidVlotgemeten · 108.5 tokens/sec
Werkgeheugen200K tokenshoeveel tekst het tegelijk aankan
SlimheidPrima48/100
Gemiddelde prijs-kwaliteit
20
waarde / 100
Loont de prijs?
Niet duur, niet goedkoop voor wat je krijgt.
Bespaar slim: Inkling (free)
is minstens net zo slim en is zelfs gratis. Bovendien is het minstens even goed in schrijven. Voor de meeste taken merk je het verschil nauwelijks.
Goed voor
- E-mails, teksten en samenvattingen schrijven
- Het lezen van afbeeldingen en scans
Minder geschikt voor
- Er zijn geen duidelijke beperkingen voor standaardgebruik
Aanbieder buiten de EU (Verenigde Staten & Canada). Let bij gevoelige gegevens op je verwerkersafspraken.
Geen Zero Data Retention. Voor dit model is via OpenRouter geen ZDR-aanbieder beschikbaar. Voor veel organisaties is dat een reden om het niet voor gevoelige gegevens te gebruiken.
Slimheid
48/100 · prima
Schrijven
66/100 · sterk
Programmeren
geen benchmarkdata
Agent-taken
62/100 · sterk
Geavanceerd — voor professionals
Onderstaande gegevens zijn bedoeld voor wie de techniek wil doorgronden: ruwe benchmarkscores, gemeten snelheid/latency, prijsopbouw en databronnen. Niet nodig om een goede keuze te maken.
Benchmarks
Klik op een benchmark voor uitleg en alle uitslagen per model; het ?-knopje geeft een korte uitleg.
| Intelligence Index | 31.1 |
| Samengestelde slimheidsscore van Artificial Analysis: het gemiddelde over vele tests voor redeneren, kennis, wiskunde en code. Hoger = slimmer. Alle uitslagen & uitleg → | |
| Coding Index | geen data |
| Gemiddelde van programmeertests: hoe goed het model code schrijft, begrijpt en verbetert. Alle uitslagen & uitleg → | |
| Math Index | 88.3 |
| Gemiddelde van wiskundetests: rekenen, algebra en wiskundig redeneren. Alle uitslagen & uitleg → | |
| Agentic Index | geen data |
| Hoe goed het model zelfstandig meerstaps-taken uitvoert met tools (bestanden openen, zoeken, acties uitvoeren). Alle uitslagen & uitleg → | |
| MMLU-Pro | 85.3% |
| Grote kennistest met ruim 12.000 pittige meerkeuzevragen over 14 vakgebieden (recht, economie, natuurkunde…). Meet brede kennis en redeneren. Alle uitslagen & uitleg → | |
| GPQA Diamond | 82.7% |
| Zeer moeilijke wetenschapsvragen op PhD-niveau (biologie, natuur- en scheikunde). Zelfs menselijke experts halen hier maar ~65%. Alle uitslagen & uitleg → | |
| Humanity's Last Exam | 20.1% |
| De zwaarste kennistest die er is: duizenden extreem moeilijke vragen over honderden onderwerpen. Lage percentages zijn hier normaal. Alle uitslagen & uitleg → | |
| LiveCodeBench | 80.8% |
| Verse programmeeropgaven die pas ná de training van het model zijn verschenen — meet écht kunnen programmeren in plaats van onthouden. Alle uitslagen & uitleg → | |
| SciCode | 41% |
| Programmeeropgaven uit echte wetenschappelijke onderzoekspapers — combineert code en vakkennis. Alle uitslagen & uitleg → | |
| AIME (wiskunde) | 88.3% |
| Vragen van de Amerikaanse wiskunde-olympiade voor scholieren. Meet geavanceerd wiskundig redeneren. Alle uitslagen & uitleg → | |
| IFBench (instructievolgen) | 71.4% |
| Meet hoe precies het model instructies opvolgt, zoals eisen aan lengte, opmaak of vorm van het antwoord. Alle uitslagen & uitleg → | |
| τ²-bench (agent-taken) | 80.7% |
| Realistische klantenservice-scenario's (vluchten omboeken, abonnementen wijzigen) waarin het model zelfstandig regels moet volgen en tools gebruiken. Alle uitslagen & uitleg → | |
| Terminal-Bench (agent-taken) | 37.1% |
| Opdrachten die het model zelfstandig in een computerterminal moet uitvoeren — een zware test voor agent-vaardigheden. Alle uitslagen & uitleg → | |
Prestaties (gemeten)
| Output-snelheid | 108.5 tokens/sec |
| Time-to-first-token (latency) | 6.73 sec |
| Snelheidsbron | gemeten (Artificial Analysis) |
Design Arena (ELO)
Head-to-head ranglijst waarin modellen het tegen elkaar opnemen op praktijktaken (websites, code, UI, datavisualisatie). Hogere ELO = vaker gewonnen.
| Gemiddelde ELO | 1083 |
| dataviz | ELO 1200 · rang 50 |
| gamedev | ELO 1071 · rang 94 |
| uicomponent | ELO 1043 · rang 96 |
| codecategories | ELO 1044 · rang 103 |
Technische specificaties
| Model-ID | openai/o3 |
| Contextvenster | 200.000 tokens |
| Kennis bijgewerkt tot | 2024-06-30 |
| Uitgebracht | 16 apr 2025 |
| Invoer | tekst, beeld, bestanden |
| Redeneren (reasoning) | ja |
| Populariteitsscore | 56/100 |
| Databronnen | openrouter, artificial_analysis, design_arena |