Terug
Benchmark · bron: Artificial Analysis score in %
AIME (wiskunde)
Vragen van de Amerikaanse wiskunde-olympiade voor scholieren. Meet geavanceerd wiskundig redeneren.
Wat meet deze benchmark?
AIME (American Invitational Mathematics Examination) is de Amerikaanse wiskunde-olympiade voor de allerbeste scholieren. De opgaven vergen meerstaps wiskundig redeneren — geen opzoekwerk.
Hoe werkt het?
Het model krijgt de originele examenvragen voorgelegd. Elk antwoord is een geheel getal, dus goed of fout is volledig objectief vast te stellen. De score is het percentage correct.
Hoe lees je de score?
Percentage goed. Hoge scores wijzen op sterk stapsgewijs redeneervermogen — ook nuttig buiten wiskunde, bv. bij analyse en logica.
Alle uitslagen
48 modellen met een AIME (wiskunde)-score, van hoog naar laag. Klik een model voor alle details.
1
GPT-5.2OpenAI
🇺🇸Verenigde Staten
99%
2
GPT-5.2 ChatOpenAI
🇺🇸Verenigde Staten
99%
3
GPT-5.1-CodexOpenAI
🇺🇸Verenigde Staten
95.7%
4
GPT-5OpenAI
🇺🇸Verenigde Staten
94.3%
5
GPT-5.1OpenAI
🇺🇸Verenigde Staten
94%
6
gpt-oss-120bOpenAI
🇺🇸Verenigde Staten
93.4%
7
GPT-5.1-Codex-MiniOpenAI
🇺🇸Verenigde Staten
91.7%
8
o4 Mini HighOpenAI
🇺🇸Verenigde Staten
90.7%
9
o4 MiniOpenAI
🇺🇸Verenigde Staten
90.7%
10
gpt-oss-20bOpenAI
🇺🇸Verenigde Staten
89.3%
11
o3OpenAI
🇺🇸Verenigde Staten
88.3%
12
Gemini 2.5 Pro Preview 06-05Google
🇺🇸Verenigde Staten
87.7%
13
Gemini 2.5 ProGoogle
🇺🇸Verenigde Staten
87.7%
14
GPT-5 MiniOpenAI
🇺🇸Verenigde Staten
85%
15
Gemini 2.5 Pro Preview 05-06Google
🇺🇸Verenigde Staten
84.3%
16
GPT-5 NanoOpenAI
🇺🇸Verenigde Staten
83.7%
17
Sonar Reasoning ProPerplexity
🇺🇸Verenigde Staten
79%
18
Sonar ProPerplexity
🇺🇸Verenigde Staten
79%
19
o3 Mini HighOpenAI
🇺🇸Verenigde Staten
77%
20
o3 MiniOpenAI
🇺🇸Verenigde Staten
77%
21
SonarPerplexity
🇺🇸Verenigde Staten
77%
22
Olmo 3 32B ThinkAllenAI
🇺🇸Verenigde Staten
73.7%
23
o1OpenAI
🇺🇸Verenigde Staten
72.3%
24
Gemini 2.5 Flash LiteGoogle
🇺🇸Verenigde Staten
53.3%
25
Mistral Medium 3.1Mistral AI
🇫🇷Frankrijk
38.3%
26
GPT-4.1OpenAI
🇺🇸Verenigde Staten
34.7%
27
Reka Flash 3Reka
🇺🇸Verenigde Staten
33.7%
28
Mistral Medium 3Mistral AI
🇫🇷Frankrijk
30.3%
29
Gemma 3 27BGoogle
🇺🇸Verenigde Staten
20.7%
30
Llama 4 MaverickMeta
🇺🇸Verenigde Staten
19.3%
31
Gemma 3 12BGoogle
🇺🇸Verenigde Staten
18.3%
32
Phi 4Microsoft
🇺🇸Verenigde Staten
18%
33
GPT-4 TurboOpenAI
🇺🇸Verenigde Staten
15%
34
GPT-4o-mini (2024-07-18)OpenAI
🇺🇸Verenigde Staten
14.7%
35
GPT-4o-miniOpenAI
🇺🇸Verenigde Staten
14.7%
36
Llama 4 ScoutMeta
🇺🇸Verenigde Staten
14%
37
Command ACohere
🇨🇦Canada
13%
38
SabaMistral AI
🇫🇷Frankrijk
13%
39
Gemma 3 4BGoogle
🇺🇸Verenigde Staten
12.7%
40
Llama 3.3 70B InstructMeta
🇺🇸Verenigde Staten
7.7%
41
GPT-4o (2024-11-20)OpenAI
🇺🇸Verenigde Staten
6%
42
Granite 4.0 MicroIBM
🇺🇸Verenigde Staten
6%
43
Mistral Small 3Mistral AI
🇫🇷Frankrijk
4.3%
44
Llama 3.1 8B InstructMeta
🇺🇸Verenigde Staten
4.3%
45
Llama 3.2 3B InstructMeta
🇺🇸Verenigde Staten
3.3%
46
Hermes 3 70B InstructNous Research
🇺🇸Verenigde Staten
2.3%
47
Claude 3 HaikuAnthropic
🇺🇸Verenigde Staten
1%
48
Llama 3.2 1B InstructMeta
🇺🇸Verenigde Staten
0%
Kleur = niveau:
Topklasse
Professioneel
Standaard
Lichtgewicht