Direct naar de inhoud
ModelCompass powered by Wux AI
Terug
Benchmark · bron: Artificial Analysis score in %

LiveCodeBench

Verse programmeeropgaven die pas ná de training van het model zijn verschenen — meet écht kunnen programmeren in plaats van onthouden.

Wat meet deze benchmark?

LiveCodeBench test programmeren met opgaven van wedstrijdsites als LeetCode, AtCoder en Codeforces. Cruciaal: alleen opgaven die ná de trainingsdatum van het model zijn gepubliceerd tellen mee.

Hoe werkt het?

Zo meet de test echt probleemoplossend vermogen in plaats van uit het hoofd geleerde antwoorden. De gegenereerde code wordt automatisch uitgevoerd en getest; de score is het percentage opgaven dat slaagt.

Hoe lees je de score?

Percentage geslaagde opgaven. Een goede graadmeter voor dagelijks programmeerwerk met nieuwe, onbekende problemen.

Alle uitslagen

44 modellen met een LiveCodeBench-score, van hoog naar laag. Klik een model voor alle details.

1 GPT-5.2OpenAI 🇺🇸Verenigde Staten 88.9% 2 GPT-5.2 ChatOpenAI 🇺🇸Verenigde Staten 88.9% 3 gpt-oss-120bOpenAI 🇺🇸Verenigde Staten 87.8% 4 GPT-5.1OpenAI 🇺🇸Verenigde Staten 86.8% 5 o4 Mini HighOpenAI 🇺🇸Verenigde Staten 85.9% 6 o4 MiniOpenAI 🇺🇸Verenigde Staten 85.9% 7 GPT-5.1-CodexOpenAI 🇺🇸Verenigde Staten 84.9% 8 GPT-5OpenAI 🇺🇸Verenigde Staten 84.6% 9 GPT-5.1-Codex-MiniOpenAI 🇺🇸Verenigde Staten 83.6% 10 o3OpenAI 🇺🇸Verenigde Staten 80.8% 11 Gemini 2.5 Pro Preview 06-05Google 🇺🇸Verenigde Staten 80.1% 12 Gemini 2.5 ProGoogle 🇺🇸Verenigde Staten 80.1% 13 GPT-5 NanoOpenAI 🇺🇸Verenigde Staten 78.9% 14 gpt-oss-20bOpenAI 🇺🇸Verenigde Staten 77.7% 15 Gemini 2.5 Pro Preview 05-06Google 🇺🇸Verenigde Staten 77% 16 o3 Mini HighOpenAI 🇺🇸Verenigde Staten 71.7% 17 o3 MiniOpenAI 🇺🇸Verenigde Staten 71.7% 18 GPT-5 MiniOpenAI 🇺🇸Verenigde Staten 69.2% 19 o1OpenAI 🇺🇸Verenigde Staten 67.9% 20 Olmo 3 32B ThinkAllenAI 🇺🇸Verenigde Staten 67.2% 21 Gemini 2.5 Flash LiteGoogle 🇺🇸Verenigde Staten 59.3% 22 GPT-4.1OpenAI 🇺🇸Verenigde Staten 45.7% 23 Reka Flash 3Reka 🇺🇸Verenigde Staten 43.5% 24 Mistral Medium 3.1Mistral AI 🇫🇷Frankrijk 40.6% 25 Mistral Medium 3Mistral AI 🇫🇷Frankrijk 40% 26 Llama 4 MaverickMeta 🇺🇸Verenigde Staten 39.7% 27 GPT-4o (2024-11-20)OpenAI 🇺🇸Verenigde Staten 30.9% 28 Llama 4 ScoutMeta 🇺🇸Verenigde Staten 29.9% 29 GPT-4 TurboOpenAI 🇺🇸Verenigde Staten 29.1% 30 Llama 3.3 70B InstructMeta 🇺🇸Verenigde Staten 28.8% 31 Command ACohere 🇨🇦Canada 28.7% 32 Mistral Small 3Mistral AI 🇫🇷Frankrijk 25.2% 33 GPT-4o-mini (2024-07-18)OpenAI 🇺🇸Verenigde Staten 23.4% 34 GPT-4o-miniOpenAI 🇺🇸Verenigde Staten 23.4% 35 Phi 4Microsoft 🇺🇸Verenigde Staten 23.1% 36 Hermes 3 70B InstructNous Research 🇺🇸Verenigde Staten 18.8% 37 Granite 4.0 MicroIBM 🇺🇸Verenigde Staten 18% 38 Claude 3 HaikuAnthropic 🇺🇸Verenigde Staten 15.4% 39 Gemma 3 27BGoogle 🇺🇸Verenigde Staten 13.7% 40 Gemma 3 12BGoogle 🇺🇸Verenigde Staten 13.7% 41 Llama 3.1 8B InstructMeta 🇺🇸Verenigde Staten 11.6% 42 Gemma 3 4BGoogle 🇺🇸Verenigde Staten 11.2% 43 Llama 3.2 3B InstructMeta 🇺🇸Verenigde Staten 8.3% 44 Llama 3.2 1B InstructMeta 🇺🇸Verenigde Staten 1.9%
Kleur = niveau: Topklasse Professioneel Standaard Lichtgewicht