Terug
Benchmark Β· bron: Artificial Analysis score in %
IFBench (instructievolgen)
Meet hoe precies het model instructies opvolgt, zoals eisen aan lengte, opmaak of vorm van het antwoord.
Wat meet deze benchmark?
IFBench (Instruction Following Benchmark) meet hoe precies een model instructies opvolgt: eisen aan lengte, opmaak, structuur of verplichte woorden in het antwoord.
Hoe werkt het?
Elke opdracht bevat automatisch controleerbare eisen ("maximaal 100 woorden", "eindig met een vraag"). Een controlescript stelt vast of het model zich er exact aan houdt.
Hoe lees je de score?
Percentage correct opgevolgde instructies. Belangrijk voor de praktijk: een slim model dat instructies negeert, is alsnog onbruikbaar in workflows.
Alle uitslagen
64 modellen met een IFBench (instructievolgen)-score, van hoog naar laag. Klik een model voor alle details.
1
MiniMax M3MiniMax
π¨π³China
82.9%
2
Grok 4.3xAI (Grok)
πΊπΈVerenigde Staten
81.3%
3
Grok 4.20xAI (Grok)
πΊπΈVerenigde Staten
81.2%
4
Qwen3.7 MaxAlibaba (Qwen)
π¨π³China
80.5%
5
Gemini 3.1 Flash LiteGoogle
πΊπΈVerenigde Staten
77.2%
6
Gemini 3.1 Flash Lite PreviewGoogle
πΊπΈVerenigde Staten
77.2%
7
Gemini 3.1 Pro PreviewGoogle
πΊπΈVerenigde Staten
77.1%
8
Kimi K2.6Moonshot AI
π¨π³China
76%
9
GPT-5.5OpenAI
πΊπΈVerenigde Staten
75.9%
10
Gemma 4 31BGoogle
πΊπΈVerenigde Staten
75.6%
11
Gemma 4 31B (free)Google
πΊπΈVerenigde Staten
75.6%
12
GPT-5.3-CodexOpenAI
πΊπΈVerenigde Staten
75.4%
13
GPT-5.2OpenAI
πΊπΈVerenigde Staten
75.4%
14
GPT-5.2 ChatOpenAI
πΊπΈVerenigde Staten
75.4%
15
GLM 5.2Z.ai
π¨π³China
73.3%
16
GLM 5.2 (free)Z.ai
π¨π³China
73.3%
17
GPT-5OpenAI
πΊπΈVerenigde Staten
73.1%
18
GPT-5.1OpenAI
πΊπΈVerenigde Staten
72.9%
19
GPT-5.6 SolOpenAI
πΊπΈVerenigde Staten
72.7%
20
Gemma 4 26B A4BGoogle
πΊπΈVerenigde Staten
72.4%
21
Gemma 4 26B A4B (free)Google
πΊπΈVerenigde Staten
72.4%
22
o3OpenAI
πΊπΈVerenigde Staten
71.4%
23
GPT-5.6 TerraOpenAI
πΊπΈVerenigde Staten
71.2%
24
GPT-5 MiniOpenAI
πΊπΈVerenigde Staten
71.2%
25
o1OpenAI
πΊπΈVerenigde Staten
70.3%
26
GPT-5.1-CodexOpenAI
πΊπΈVerenigde Staten
70%
27
gpt-oss-120bOpenAI
πΊπΈVerenigde Staten
69%
28
Mistral Medium 3.5Mistral AI
π«π·Frankrijk
68.8%
29
o4 Mini HighOpenAI
πΊπΈVerenigde Staten
68.7%
30
o4 MiniOpenAI
πΊπΈVerenigde Staten
68.7%
31
GPT-5.1-Codex-MiniOpenAI
πΊπΈVerenigde Staten
67.9%
32
GPT-5 NanoOpenAI
πΊπΈVerenigde Staten
67.6%
33
gpt-oss-20bOpenAI
πΊπΈVerenigde Staten
65.1%
34
Claude Fable 5Anthropic
πΊπΈVerenigde Staten
63.5%
35
Nemotron 3 Nano Omni (free)NVIDIA
πΊπΈVerenigde Staten
63.2%
36
North Mini Code (free)Cohere
π¨π¦Canada
57.6%
37
Trinity Large ThinkingArcee AI
πΊπΈVerenigde Staten
56.3%
38
Gemini 2.5 Flash LiteGoogle
πΊπΈVerenigde Staten
49.9%
39
Olmo 3 32B ThinkAllenAI
πΊπΈVerenigde Staten
49.1%
40
Gemini 2.5 Pro Preview 06-05Google
πΊπΈVerenigde Staten
48.7%
41
Gemini 2.5 ProGoogle
πΊπΈVerenigde Staten
48.7%
42
Mistral Small 4Mistral AI
π«π·Frankrijk
48.2%
43
Llama 3.3 70B InstructMeta
πΊπΈVerenigde Staten
47.1%
44
GPT-4.1OpenAI
πΊπΈVerenigde Staten
43%
45
Llama 4 MaverickMeta
πΊπΈVerenigde Staten
43%
46
Mistral Medium 3.1Mistral AI
π«π·Frankrijk
39.8%
47
Llama 4 ScoutMeta
πΊπΈVerenigde Staten
39.5%
48
Mistral Medium 3Mistral AI
π«π·Frankrijk
39.3%
49
Granite 4.1 8BIBM
πΊπΈVerenigde Staten
38.6%
50
Gemma 3 12BGoogle
πΊπΈVerenigde Staten
36.7%
51
Command ACohere
π¨π¦Canada
36.5%
52
Claude 3 HaikuAnthropic
πΊπΈVerenigde Staten
36.1%
53
GPT-4o (2024-11-20)OpenAI
πΊπΈVerenigde Staten
34.3%
54
Gemma 3 27BGoogle
πΊπΈVerenigde Staten
31.8%
55
GPT-4o-mini (2024-07-18)OpenAI
πΊπΈVerenigde Staten
31%
56
GPT-4o-miniOpenAI
πΊπΈVerenigde Staten
31%
57
Reka Flash 3Reka
πΊπΈVerenigde Staten
30.4%
58
Llama 3.1 8B InstructMeta
πΊπΈVerenigde Staten
28.6%
59
Gemma 3 4BGoogle
πΊπΈVerenigde Staten
28.3%
60
Mistral Small 3Mistral AI
π«π·Frankrijk
26.4%
61
Llama 3.2 3B InstructMeta
πΊπΈVerenigde Staten
26.2%
62
Granite 4.0 MicroIBM
πΊπΈVerenigde Staten
24.8%
63
Phi 4Microsoft
πΊπΈVerenigde Staten
23.5%
64
Llama 3.2 1B InstructMeta
πΊπΈVerenigde Staten
22.8%
Kleur = niveau:
Topklasse
Professioneel
Standaard
Lichtgewicht