Terug naar overzicht
🇫🇷 Mistral AI · Frankrijk EU · AVG Geen ZDR
Mistral Medium 3.1
Niveau: Standaard
Ruim voldoende voor de meeste dagelijkse taken, en een stuk voordeliger dan de topklasse.
Mistral Medium 3.1 is an updated version of Mistral Medium 3, which is a high-performance enterprise-grade language model designed to deliver frontier-level capabilities at significantly reduced operational cost. It balances...
KostenLaag
SnelheidVlotinschatting
Werkgeheugen131K tokenshoeveel tekst het tegelijk aankan
SlimheidBasaal23/100
Gemiddelde prijs-kwaliteit
14
waarde / 100
Loont de prijs?
Niet duur, niet goedkoop voor wat je krijgt.
Bespaar slim: Inkling (free)
is minstens net zo slim en is zelfs gratis. Voor de meeste taken merk je het verschil nauwelijks.
Goed voor
- Het lezen van afbeeldingen en scans
Minder geschikt voor
- Zwaar programmeerwerk
Europese aanbieder. Valt onder EU-recht — doorgaans gunstiger voor privacy en de AVG.
Geen Zero Data Retention. Voor dit model is via OpenRouter geen ZDR-aanbieder beschikbaar. Voor veel organisaties is dat een reden om het niet voor gevoelige gegevens te gebruiken.
Slimheid
23/100 · basaal
Schrijven
35/100 · basaal
Programmeren
25/100 · basaal
Agent-taken
10/100 · beperkt
Geavanceerd — voor professionals
Onderstaande gegevens zijn bedoeld voor wie de techniek wil doorgronden: ruwe benchmarkscores, gemeten snelheid/latency, prijsopbouw en databronnen. Niet nodig om een goede keuze te maken.
Benchmarks
Klik op een benchmark voor uitleg en alle uitslagen per model; het ?-knopje geeft een korte uitleg.
| Intelligence Index | 14.7 |
| Samengestelde slimheidsscore van Artificial Analysis: het gemiddelde over vele tests voor redeneren, kennis, wiskunde en code. Hoger = slimmer. Alle uitslagen & uitleg → | |
| Coding Index | 20.5 |
| Gemiddelde van programmeertests: hoe goed het model code schrijft, begrijpt en verbetert. Alle uitslagen & uitleg → | |
| Math Index | 38.3 |
| Gemiddelde van wiskundetests: rekenen, algebra en wiskundig redeneren. Alle uitslagen & uitleg → | |
| Agentic Index | 6.1 |
| Hoe goed het model zelfstandig meerstaps-taken uitvoert met tools (bestanden openen, zoeken, acties uitvoeren). Alle uitslagen & uitleg → | |
| MMLU-Pro | 68.3% |
| Grote kennistest met ruim 12.000 pittige meerkeuzevragen over 14 vakgebieden (recht, economie, natuurkunde…). Meet brede kennis en redeneren. Alle uitslagen & uitleg → | |
| GPQA Diamond | 58.8% |
| Zeer moeilijke wetenschapsvragen op PhD-niveau (biologie, natuur- en scheikunde). Zelfs menselijke experts halen hier maar ~65%. Alle uitslagen & uitleg → | |
| Humanity's Last Exam | 4.7% |
| De zwaarste kennistest die er is: duizenden extreem moeilijke vragen over honderden onderwerpen. Lage percentages zijn hier normaal. Alle uitslagen & uitleg → | |
| LiveCodeBench | 40.6% |
| Verse programmeeropgaven die pas ná de training van het model zijn verschenen — meet écht kunnen programmeren in plaats van onthouden. Alle uitslagen & uitleg → | |
| SciCode | 33.8% |
| Programmeeropgaven uit echte wetenschappelijke onderzoekspapers — combineert code en vakkennis. Alle uitslagen & uitleg → | |
| AIME (wiskunde) | 38.3% |
| Vragen van de Amerikaanse wiskunde-olympiade voor scholieren. Meet geavanceerd wiskundig redeneren. Alle uitslagen & uitleg → | |
| IFBench (instructievolgen) | 39.8% |
| Meet hoe precies het model instructies opvolgt, zoals eisen aan lengte, opmaak of vorm van het antwoord. Alle uitslagen & uitleg → | |
| τ²-bench (agent-taken) | 40.6% |
| Realistische klantenservice-scenario's (vluchten omboeken, abonnementen wijzigen) waarin het model zelfstandig regels moet volgen en tools gebruiken. Alle uitslagen & uitleg → | |
| Terminal-Bench (agent-taken) | 13.9% |
| Opdrachten die het model zelfstandig in een computerterminal moet uitvoeren — een zware test voor agent-vaardigheden. Alle uitslagen & uitleg → | |
Prestaties (gemeten)
| Output-snelheid | geen data |
| Time-to-first-token (latency) | geen data |
| Snelheidsbron | inschatting o.b.v. modelklasse |
Design Arena (ELO)
Head-to-head ranglijst waarin modellen het tegen elkaar opnemen op praktijktaken (websites, code, UI, datavisualisatie). Hogere ELO = vaker gewonnen.
| Gemiddelde ELO | 1111 |
| asciiart | ELO 1025 · rang 59 |
| dataviz | ELO 1166 · rang 67 |
| svg | ELO 1033 · rang 74 |
| 3d | ELO 1127 · rang 77 |
Technische specificaties
| Model-ID | mistralai/mistral-medium-3.1 |
| Contextvenster | 131.072 tokens |
| Kennis bijgewerkt tot | 2025-06-30 |
| Uitgebracht | 13 aug 2025 |
| Invoer | tekst, beeld, bestanden |
| Redeneren (reasoning) | nee |
| Populariteitsscore | 47/100 |
| Databronnen | openrouter, artificial_analysis, design_arena |