Direct naar de inhoud
ModelCompass powered by Wux AI
Terug
Benchmark · bron: Artificial Analysis indexcijfer

Math Index

Gemiddelde van wiskundetests: rekenen, algebra en wiskundig redeneren.

Wat meet deze benchmark?

De Math Index vat meerdere wiskunde-benchmarks (waaronder AIME) samen tot één cijfer voor wiskundig redeneren — van rekenwerk tot olympiade-opgaven.

Hoe werkt het?

De modellen krijgen dezelfde wiskundeopgaven voorgelegd; antwoorden zijn objectief goed of fout. De scores worden gemiddeld tot één index.

Hoe lees je de score?

Indexcijfer: hoger is beter. Relevant voor data-analyse, berekeningen en logisch redeneren.

Alle uitslagen

37 modellen met een Math Index-score, van hoog naar laag. Klik een model voor alle details.

1 GPT-5.2OpenAI 🇺🇸Verenigde Staten 99 2 GPT-5.2 ChatOpenAI 🇺🇸Verenigde Staten 99 3 GPT-5.1-CodexOpenAI 🇺🇸Verenigde Staten 95.7 4 GPT-5OpenAI 🇺🇸Verenigde Staten 94.3 5 GPT-5.1OpenAI 🇺🇸Verenigde Staten 94 6 gpt-oss-120bOpenAI 🇺🇸Verenigde Staten 93.4 7 GPT-5.1-Codex-MiniOpenAI 🇺🇸Verenigde Staten 91.7 8 o4 Mini HighOpenAI 🇺🇸Verenigde Staten 90.7 9 o4 MiniOpenAI 🇺🇸Verenigde Staten 90.7 10 gpt-oss-20bOpenAI 🇺🇸Verenigde Staten 89.3 11 o3OpenAI 🇺🇸Verenigde Staten 88.3 12 Gemini 2.5 Pro Preview 06-05Google 🇺🇸Verenigde Staten 87.7 13 Gemini 2.5 ProGoogle 🇺🇸Verenigde Staten 87.7 14 GPT-5 MiniOpenAI 🇺🇸Verenigde Staten 85 15 GPT-5 NanoOpenAI 🇺🇸Verenigde Staten 83.7 16 Olmo 3 32B ThinkAllenAI 🇺🇸Verenigde Staten 73.7 17 Gemini 2.5 Flash LiteGoogle 🇺🇸Verenigde Staten 53.3 18 Mistral Medium 3.1Mistral AI 🇫🇷Frankrijk 38.3 19 GPT-4.1OpenAI 🇺🇸Verenigde Staten 34.7 20 Reka Flash 3Reka 🇺🇸Verenigde Staten 33.7 21 Mistral Medium 3Mistral AI 🇫🇷Frankrijk 30.3 22 Gemma 3 27BGoogle 🇺🇸Verenigde Staten 20.7 23 Llama 4 MaverickMeta 🇺🇸Verenigde Staten 19.3 24 Gemma 3 12BGoogle 🇺🇸Verenigde Staten 18.3 25 Phi 4Microsoft 🇺🇸Verenigde Staten 18 26 GPT-4o-mini (2024-07-18)OpenAI 🇺🇸Verenigde Staten 14.7 27 GPT-4o-miniOpenAI 🇺🇸Verenigde Staten 14.7 28 Llama 4 ScoutMeta 🇺🇸Verenigde Staten 14 29 Command ACohere 🇨🇦Canada 13 30 Gemma 3 4BGoogle 🇺🇸Verenigde Staten 12.7 31 Llama 3.3 70B InstructMeta 🇺🇸Verenigde Staten 7.7 32 GPT-4o (2024-11-20)OpenAI 🇺🇸Verenigde Staten 6 33 Granite 4.0 MicroIBM 🇺🇸Verenigde Staten 6 34 Mistral Small 3Mistral AI 🇫🇷Frankrijk 4.3 35 Llama 3.1 8B InstructMeta 🇺🇸Verenigde Staten 4.3 36 Llama 3.2 3B InstructMeta 🇺🇸Verenigde Staten 3.3 37 Llama 3.2 1B InstructMeta 🇺🇸Verenigde Staten 0
Kleur = niveau: Topklasse Professioneel Standaard Lichtgewicht