Direct naar de inhoud
ModelCompass powered by Wux AI
Terug
Benchmark · bron: Artificial Analysis score in %

AIME (wiskunde)

Vragen van de Amerikaanse wiskunde-olympiade voor scholieren. Meet geavanceerd wiskundig redeneren.

Wat meet deze benchmark?

AIME (American Invitational Mathematics Examination) is de Amerikaanse wiskunde-olympiade voor de allerbeste scholieren. De opgaven vergen meerstaps wiskundig redeneren — geen opzoekwerk.

Hoe werkt het?

Het model krijgt de originele examenvragen voorgelegd. Elk antwoord is een geheel getal, dus goed of fout is volledig objectief vast te stellen. De score is het percentage correct.

Hoe lees je de score?

Percentage goed. Hoge scores wijzen op sterk stapsgewijs redeneervermogen — ook nuttig buiten wiskunde, bv. bij analyse en logica.

Alle uitslagen

48 modellen met een AIME (wiskunde)-score, van hoog naar laag. Klik een model voor alle details.

1 GPT-5.2OpenAI 🇺🇸Verenigde Staten 99% 2 GPT-5.2 ChatOpenAI 🇺🇸Verenigde Staten 99% 3 GPT-5.1-CodexOpenAI 🇺🇸Verenigde Staten 95.7% 4 GPT-5OpenAI 🇺🇸Verenigde Staten 94.3% 5 GPT-5.1OpenAI 🇺🇸Verenigde Staten 94% 6 gpt-oss-120bOpenAI 🇺🇸Verenigde Staten 93.4% 7 GPT-5.1-Codex-MiniOpenAI 🇺🇸Verenigde Staten 91.7% 8 o4 Mini HighOpenAI 🇺🇸Verenigde Staten 90.7% 9 o4 MiniOpenAI 🇺🇸Verenigde Staten 90.7% 10 gpt-oss-20bOpenAI 🇺🇸Verenigde Staten 89.3% 11 o3OpenAI 🇺🇸Verenigde Staten 88.3% 12 Gemini 2.5 Pro Preview 06-05Google 🇺🇸Verenigde Staten 87.7% 13 Gemini 2.5 ProGoogle 🇺🇸Verenigde Staten 87.7% 14 GPT-5 MiniOpenAI 🇺🇸Verenigde Staten 85% 15 Gemini 2.5 Pro Preview 05-06Google 🇺🇸Verenigde Staten 84.3% 16 GPT-5 NanoOpenAI 🇺🇸Verenigde Staten 83.7% 17 Sonar Reasoning ProPerplexity 🇺🇸Verenigde Staten 79% 18 Sonar ProPerplexity 🇺🇸Verenigde Staten 79% 19 o3 Mini HighOpenAI 🇺🇸Verenigde Staten 77% 20 o3 MiniOpenAI 🇺🇸Verenigde Staten 77% 21 SonarPerplexity 🇺🇸Verenigde Staten 77% 22 Olmo 3 32B ThinkAllenAI 🇺🇸Verenigde Staten 73.7% 23 o1OpenAI 🇺🇸Verenigde Staten 72.3% 24 Gemini 2.5 Flash LiteGoogle 🇺🇸Verenigde Staten 53.3% 25 Mistral Medium 3.1Mistral AI 🇫🇷Frankrijk 38.3% 26 GPT-4.1OpenAI 🇺🇸Verenigde Staten 34.7% 27 Reka Flash 3Reka 🇺🇸Verenigde Staten 33.7% 28 Mistral Medium 3Mistral AI 🇫🇷Frankrijk 30.3% 29 Gemma 3 27BGoogle 🇺🇸Verenigde Staten 20.7% 30 Llama 4 MaverickMeta 🇺🇸Verenigde Staten 19.3% 31 Gemma 3 12BGoogle 🇺🇸Verenigde Staten 18.3% 32 Phi 4Microsoft 🇺🇸Verenigde Staten 18% 33 GPT-4 TurboOpenAI 🇺🇸Verenigde Staten 15% 34 GPT-4o-mini (2024-07-18)OpenAI 🇺🇸Verenigde Staten 14.7% 35 GPT-4o-miniOpenAI 🇺🇸Verenigde Staten 14.7% 36 Llama 4 ScoutMeta 🇺🇸Verenigde Staten 14% 37 Command ACohere 🇨🇦Canada 13% 38 SabaMistral AI 🇫🇷Frankrijk 13% 39 Gemma 3 4BGoogle 🇺🇸Verenigde Staten 12.7% 40 Llama 3.3 70B InstructMeta 🇺🇸Verenigde Staten 7.7% 41 GPT-4o (2024-11-20)OpenAI 🇺🇸Verenigde Staten 6% 42 Granite 4.0 MicroIBM 🇺🇸Verenigde Staten 6% 43 Mistral Small 3Mistral AI 🇫🇷Frankrijk 4.3% 44 Llama 3.1 8B InstructMeta 🇺🇸Verenigde Staten 4.3% 45 Llama 3.2 3B InstructMeta 🇺🇸Verenigde Staten 3.3% 46 Hermes 3 70B InstructNous Research 🇺🇸Verenigde Staten 2.3% 47 Claude 3 HaikuAnthropic 🇺🇸Verenigde Staten 1% 48 Llama 3.2 1B InstructMeta 🇺🇸Verenigde Staten 0%
Kleur = niveau: Topklasse Professioneel Standaard Lichtgewicht