Terug naar overzicht
🇨🇳 Alibaba (Qwen) · China Geen ZDR #4 populair
Qwen3.8 Max
Niveau: Topklasse
De allerslimste, krachtigste modellen. Topkwaliteit voor de moeilijkste taken — en de hoogste prijs.
Qwen3.8 Max is the flagship model in Alibaba's Qwen3.8 series, the general-availability successor to the Qwen3.8 Max Preview. It is a multimodal reasoning model intended for complex reasoning, visual understanding,...
KostenGemiddeld
SnelheidGemiddeldgemeten · 45 tokens/sec
Werkgeheugen1M tokenshoeveel tekst het tegelijk aankan
SlimheidUitstekend89/100
Beste koop
39
waarde / 100
Loont de prijs?
Veel kwaliteit voor weinig geld — voor de meeste mensen de slimste keuze.
Goede keuze. Je krijgt hier veel kwaliteit voor je geld — een duurder model is voor doorsnee kantoorwerk meestal niet nodig.
Goed voor
- E-mails, teksten en samenvattingen schrijven
- Lastige vragen en analyses
- Programmeren en technische taken
- Het verwerken van hele lange documenten
- Het lezen van afbeeldingen en scans
Minder geschikt voor
- Situaties waar je heel snel antwoord wilt
Aanbieder buiten de EU (China). Weeg databescherming mee voordat je er gevoelige informatie mee verwerkt.
Geen Zero Data Retention. Voor dit model is via OpenRouter geen ZDR-aanbieder beschikbaar. Voor veel organisaties is dat een reden om het niet voor gevoelige gegevens te gebruiken.
Slimheid
89/100 · uitstekend
Schrijven
90/100 · uitzonderlijk
Programmeren
89/100 · uitstekend
Agent-taken
96/100 · uitzonderlijk
Geavanceerd — voor professionals
Onderstaande gegevens zijn bedoeld voor wie de techniek wil doorgronden: ruwe benchmarkscores, gemeten snelheid/latency, prijsopbouw en databronnen. Niet nodig om een goede keuze te maken.
Benchmarks
Klik op een benchmark voor uitleg en alle uitslagen per model; het ?-knopje geeft een korte uitleg.
| Intelligence Index | 58.1 |
| Samengestelde slimheidsscore van Artificial Analysis: het gemiddelde over vele tests voor redeneren, kennis, wiskunde en code. Hoger = slimmer. Alle uitslagen & uitleg → | |
| Coding Index | 71.8 |
| Gemiddelde van programmeertests: hoe goed het model code schrijft, begrijpt en verbetert. Alle uitslagen & uitleg → | |
| Math Index | geen data |
| Gemiddelde van wiskundetests: rekenen, algebra en wiskundig redeneren. Alle uitslagen & uitleg → | |
| Agentic Index | 58.4 |
| Hoe goed het model zelfstandig meerstaps-taken uitvoert met tools (bestanden openen, zoeken, acties uitvoeren). Alle uitslagen & uitleg → | |
| MMLU-Pro | geen data |
| Grote kennistest met ruim 12.000 pittige meerkeuzevragen over 14 vakgebieden (recht, economie, natuurkunde…). Meet brede kennis en redeneren. Alle uitslagen & uitleg → | |
| GPQA Diamond | 92.7% |
| Zeer moeilijke wetenschapsvragen op PhD-niveau (biologie, natuur- en scheikunde). Zelfs menselijke experts halen hier maar ~65%. Alle uitslagen & uitleg → | |
| Humanity's Last Exam | 43% |
| De zwaarste kennistest die er is: duizenden extreem moeilijke vragen over honderden onderwerpen. Lage percentages zijn hier normaal. Alle uitslagen & uitleg → | |
| LiveCodeBench | geen data |
| Verse programmeeropgaven die pas ná de training van het model zijn verschenen — meet écht kunnen programmeren in plaats van onthouden. Alle uitslagen & uitleg → | |
| SciCode | 52.9% |
| Programmeeropgaven uit echte wetenschappelijke onderzoekspapers — combineert code en vakkennis. Alle uitslagen & uitleg → | |
| AIME (wiskunde) | geen data |
| Vragen van de Amerikaanse wiskunde-olympiade voor scholieren. Meet geavanceerd wiskundig redeneren. Alle uitslagen & uitleg → | |
| IFBench (instructievolgen) | geen data |
| Meet hoe precies het model instructies opvolgt, zoals eisen aan lengte, opmaak of vorm van het antwoord. Alle uitslagen & uitleg → | |
| τ²-bench (agent-taken) | geen data |
| Realistische klantenservice-scenario's (vluchten omboeken, abonnementen wijzigen) waarin het model zelfstandig regels moet volgen en tools gebruiken. Alle uitslagen & uitleg → | |
| Terminal-Bench (agent-taken) | 81.3% |
| Opdrachten die het model zelfstandig in een computerterminal moet uitvoeren — een zware test voor agent-vaardigheden. Alle uitslagen & uitleg → | |
Prestaties (gemeten)
| Output-snelheid | 45 tokens/sec |
| Time-to-first-token (latency) | 1.82 sec |
| Snelheidsbron | gemeten (Artificial Analysis) |
Design Arena (ELO)
Head-to-head ranglijst waarin modellen het tegen elkaar opnemen op praktijktaken (websites, code, UI, datavisualisatie). Hogere ELO = vaker gewonnen.
| Gemiddelde ELO | 1330 |
| webapps | ELO 1342 · rang 1 |
| 3d | ELO 1379 · rang 3 |
| uicomponent | ELO 1358 · rang 3 |
| fullstack | ELO 1337 · rang 4 |
Technische specificaties
| Model-ID | qwen/qwen3.8-max |
| Contextvenster | 1.000.000 tokens |
| Kennis bijgewerkt tot | onbekend |
| Uitgebracht | 3 aug 2026 |
| Invoer | tekst, beeld, video |
| Redeneren (reasoning) | ja |
| Populariteitsscore | 100/100 |
| Databronnen | openrouter, artificial_analysis, design_arena, lmarena |