Terug
Benchmark · bron: Artificial Analysis score in %
LiveCodeBench
Verse programmeeropgaven die pas ná de training van het model zijn verschenen — meet écht kunnen programmeren in plaats van onthouden.
Wat meet deze benchmark?
LiveCodeBench test programmeren met opgaven van wedstrijdsites als LeetCode, AtCoder en Codeforces. Cruciaal: alleen opgaven die ná de trainingsdatum van het model zijn gepubliceerd tellen mee.
Hoe werkt het?
Zo meet de test echt probleemoplossend vermogen in plaats van uit het hoofd geleerde antwoorden. De gegenereerde code wordt automatisch uitgevoerd en getest; de score is het percentage opgaven dat slaagt.
Hoe lees je de score?
Percentage geslaagde opgaven. Een goede graadmeter voor dagelijks programmeerwerk met nieuwe, onbekende problemen.
Alle uitslagen
44 modellen met een LiveCodeBench-score, van hoog naar laag. Klik een model voor alle details.
1
GPT-5.2OpenAI
🇺🇸Verenigde Staten
88.9%
2
GPT-5.2 ChatOpenAI
🇺🇸Verenigde Staten
88.9%
3
gpt-oss-120bOpenAI
🇺🇸Verenigde Staten
87.8%
4
GPT-5.1OpenAI
🇺🇸Verenigde Staten
86.8%
5
o4 Mini HighOpenAI
🇺🇸Verenigde Staten
85.9%
6
o4 MiniOpenAI
🇺🇸Verenigde Staten
85.9%
7
GPT-5.1-CodexOpenAI
🇺🇸Verenigde Staten
84.9%
8
GPT-5OpenAI
🇺🇸Verenigde Staten
84.6%
9
GPT-5.1-Codex-MiniOpenAI
🇺🇸Verenigde Staten
83.6%
10
o3OpenAI
🇺🇸Verenigde Staten
80.8%
11
Gemini 2.5 Pro Preview 06-05Google
🇺🇸Verenigde Staten
80.1%
12
Gemini 2.5 ProGoogle
🇺🇸Verenigde Staten
80.1%
13
GPT-5 NanoOpenAI
🇺🇸Verenigde Staten
78.9%
14
gpt-oss-20bOpenAI
🇺🇸Verenigde Staten
77.7%
15
Gemini 2.5 Pro Preview 05-06Google
🇺🇸Verenigde Staten
77%
16
o3 Mini HighOpenAI
🇺🇸Verenigde Staten
71.7%
17
o3 MiniOpenAI
🇺🇸Verenigde Staten
71.7%
18
GPT-5 MiniOpenAI
🇺🇸Verenigde Staten
69.2%
19
o1OpenAI
🇺🇸Verenigde Staten
67.9%
20
Olmo 3 32B ThinkAllenAI
🇺🇸Verenigde Staten
67.2%
21
Gemini 2.5 Flash LiteGoogle
🇺🇸Verenigde Staten
59.3%
22
GPT-4.1OpenAI
🇺🇸Verenigde Staten
45.7%
23
Reka Flash 3Reka
🇺🇸Verenigde Staten
43.5%
24
Mistral Medium 3.1Mistral AI
🇫🇷Frankrijk
40.6%
25
Mistral Medium 3Mistral AI
🇫🇷Frankrijk
40%
26
Llama 4 MaverickMeta
🇺🇸Verenigde Staten
39.7%
27
GPT-4o (2024-11-20)OpenAI
🇺🇸Verenigde Staten
30.9%
28
Llama 4 ScoutMeta
🇺🇸Verenigde Staten
29.9%
29
GPT-4 TurboOpenAI
🇺🇸Verenigde Staten
29.1%
30
Llama 3.3 70B InstructMeta
🇺🇸Verenigde Staten
28.8%
31
Command ACohere
🇨🇦Canada
28.7%
32
Mistral Small 3Mistral AI
🇫🇷Frankrijk
25.2%
33
GPT-4o-mini (2024-07-18)OpenAI
🇺🇸Verenigde Staten
23.4%
34
GPT-4o-miniOpenAI
🇺🇸Verenigde Staten
23.4%
35
Phi 4Microsoft
🇺🇸Verenigde Staten
23.1%
36
Hermes 3 70B InstructNous Research
🇺🇸Verenigde Staten
18.8%
37
Granite 4.0 MicroIBM
🇺🇸Verenigde Staten
18%
38
Claude 3 HaikuAnthropic
🇺🇸Verenigde Staten
15.4%
39
Gemma 3 27BGoogle
🇺🇸Verenigde Staten
13.7%
40
Gemma 3 12BGoogle
🇺🇸Verenigde Staten
13.7%
41
Llama 3.1 8B InstructMeta
🇺🇸Verenigde Staten
11.6%
42
Gemma 3 4BGoogle
🇺🇸Verenigde Staten
11.2%
43
Llama 3.2 3B InstructMeta
🇺🇸Verenigde Staten
8.3%
44
Llama 3.2 1B InstructMeta
🇺🇸Verenigde Staten
1.9%
Kleur = niveau:
Topklasse
Professioneel
Standaard
Lichtgewicht