Terug naar overzicht
🇺🇸 Google · Verenigde Staten ZDR mogelijk
Gemini 2.5 Pro (batch)
Niveau: Standaard
Ruim voldoende voor de meeste dagelijkse taken, en een stuk voordeliger dan de topklasse.
Gemini 2.5 Pro is Google’s state-of-the-art AI model designed for advanced reasoning, coding, mathematics, and scientific tasks. It employs “thinking” capabilities, enabling it to reason through responses with enhanced accuracy...
KostenLaag
SnelheidGemiddeldinschatting
Werkgeheugen1M tokenshoeveel tekst het tegelijk aankan
SlimheidPrima40/100
Gemiddelde prijs-kwaliteit
20
waarde / 100
Loont de prijs?
Niet duur, niet goedkoop voor wat je krijgt.
Bespaar slim: Inkling (free)
is minstens net zo slim en is zelfs gratis. Bovendien is het sneller. Voor de meeste taken merk je het verschil nauwelijks.
Goed voor
- Het verwerken van hele lange documenten
- Het lezen van afbeeldingen en scans
Minder geschikt voor
- Situaties waar je heel snel antwoord wilt
Aanbieder buiten de EU (Verenigde Staten & Canada). Let bij gevoelige gegevens op je verwerkersafspraken.
Zero Data Retention mogelijk. Dit model kan via OpenRouter worden ingezet bij een aanbieder die je invoer niet bewaart en niet gebruikt voor training — belangrijk voor vertrouwelijke bedrijfsgegevens. Stel ZDR in je OpenRouter-account in om dit af te dwingen.
Slimheid
40/100 · prima
Schrijven
40/100 · prima
Programmeren
41/100 · prima
Agent-taken
12/100 · beperkt
Geavanceerd — voor professionals
Onderstaande gegevens zijn bedoeld voor wie de techniek wil doorgronden: ruwe benchmarkscores, gemeten snelheid/latency, prijsopbouw en databronnen. Niet nodig om een goede keuze te maken.
Benchmarks
Klik op een benchmark voor uitleg en alle uitslagen per model; het ?-knopje geeft een korte uitleg.
| Intelligence Index | 25.9 |
| Samengestelde slimheidsscore van Artificial Analysis: het gemiddelde over vele tests voor redeneren, kennis, wiskunde en code. Hoger = slimmer. Alle uitslagen & uitleg → | |
| Coding Index | 33.3 |
| Gemiddelde van programmeertests: hoe goed het model code schrijft, begrijpt en verbetert. Alle uitslagen & uitleg → | |
| Math Index | geen data |
| Gemiddelde van wiskundetests: rekenen, algebra en wiskundig redeneren. Alle uitslagen & uitleg → | |
| Agentic Index | 7.2 |
| Hoe goed het model zelfstandig meerstaps-taken uitvoert met tools (bestanden openen, zoeken, acties uitvoeren). Alle uitslagen & uitleg → | |
| MMLU-Pro | geen data |
| Grote kennistest met ruim 12.000 pittige meerkeuzevragen over 14 vakgebieden (recht, economie, natuurkunde…). Meet brede kennis en redeneren. Alle uitslagen & uitleg → | |
| GPQA Diamond | geen data |
| Zeer moeilijke wetenschapsvragen op PhD-niveau (biologie, natuur- en scheikunde). Zelfs menselijke experts halen hier maar ~65%. Alle uitslagen & uitleg → | |
| Humanity's Last Exam | geen data |
| De zwaarste kennistest die er is: duizenden extreem moeilijke vragen over honderden onderwerpen. Lage percentages zijn hier normaal. Alle uitslagen & uitleg → | |
| LiveCodeBench | geen data |
| Verse programmeeropgaven die pas ná de training van het model zijn verschenen — meet écht kunnen programmeren in plaats van onthouden. Alle uitslagen & uitleg → | |
| SciCode | geen data |
| Programmeeropgaven uit echte wetenschappelijke onderzoekspapers — combineert code en vakkennis. Alle uitslagen & uitleg → | |
| AIME (wiskunde) | geen data |
| Vragen van de Amerikaanse wiskunde-olympiade voor scholieren. Meet geavanceerd wiskundig redeneren. Alle uitslagen & uitleg → | |
| IFBench (instructievolgen) | geen data |
| Meet hoe precies het model instructies opvolgt, zoals eisen aan lengte, opmaak of vorm van het antwoord. Alle uitslagen & uitleg → | |
| τ²-bench (agent-taken) | geen data |
| Realistische klantenservice-scenario's (vluchten omboeken, abonnementen wijzigen) waarin het model zelfstandig regels moet volgen en tools gebruiken. Alle uitslagen & uitleg → | |
| Terminal-Bench (agent-taken) | geen data |
| Opdrachten die het model zelfstandig in een computerterminal moet uitvoeren — een zware test voor agent-vaardigheden. Alle uitslagen & uitleg → | |
Prestaties (gemeten)
| Output-snelheid | geen data |
| Time-to-first-token (latency) | geen data |
| Snelheidsbron | inschatting o.b.v. modelklasse |
Design Arena (ELO)
Head-to-head ranglijst waarin modellen het tegen elkaar opnemen op praktijktaken (websites, code, UI, datavisualisatie). Hogere ELO = vaker gewonnen.
| Gemiddelde ELO | 1175 |
| dataviz | ELO 1243 · rang 34 |
| website | ELO 1187 · rang 64 |
| codecategories | ELO 1177 · rang 65 |
| uicomponent | ELO 1166 · rang 66 |
Technische specificaties
| Model-ID | google/gemini-2.5-pro:batch |
| Contextvenster | 1.048.576 tokens |
| Kennis bijgewerkt tot | 2025-01-31 |
| Uitgebracht | 17 jun 2025 |
| Invoer | tekst, beeld, audio, video, bestanden |
| Redeneren (reasoning) | ja |
| Populariteitsscore | 37/100 |
| Databronnen | openrouter, design_arena |