Direct naar de inhoud
ModelCompass powered by Wux AI
Terug naar overzicht
🇺🇸 Meta · Verenigde Staten ZDR mogelijk

Llama 3.3 70B Instruct

Niveau: Lichtgewicht Supersnel en zeer goedkoop. Ideaal voor eenvoudige taken op grote schaal, zoals chat en korte teksten.

The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). The Llama 3.3 instruction tuned text only model...

Uitgebracht: 6 dec 2024 Contextvenster: 131K tokens Kennis tot: 2023-12-31
KostenZeer laag
SnelheidVlotgemeten · 88.1 tokens/sec
Werkgeheugen131K tokenshoeveel tekst het tegelijk aankan
SlimheidBeperkt14/100
Gemiddelde prijs-kwaliteit 13 waarde / 100

Loont de prijs?

Niet duur, niet goedkoop voor wat je krijgt.

Goed voor

  • Algemeen, alledaags gebruik

Minder geschikt voor

  • Zwaar programmeerwerk
Aanbieder buiten de EU (Verenigde Staten & Canada). Let bij gevoelige gegevens op je verwerkersafspraken.
Zero Data Retention mogelijk. Dit model kan via OpenRouter worden ingezet bij een aanbieder die je invoer niet bewaart en niet gebruikt voor training — belangrijk voor vertrouwelijke bedrijfsgegevens. Stel ZDR in je OpenRouter-account in om dit af te dwingen.
Slimheid
14/100 · beperkt
Schrijven
43/100 · prima
Programmeren
15/100 · beperkt
Agent-taken
17/100 · beperkt
Geavanceerd — voor professionals

Onderstaande gegevens zijn bedoeld voor wie de techniek wil doorgronden: ruwe benchmarkscores, gemeten snelheid/latency, prijsopbouw en databronnen. Niet nodig om een goede keuze te maken.

Benchmarks

Klik op een benchmark voor uitleg en alle uitslagen per model; het ?-knopje geeft een korte uitleg.

Intelligence Index 9.3
Coding Index 11.9
Math Index 7.7
Agentic Index geen data
MMLU-Pro 71.3%
GPQA Diamond 49.8%
Humanity's Last Exam 3.6%
LiveCodeBench 28.8%
SciCode 26%
AIME (wiskunde) 7.7%
IFBench (instructievolgen) 47.1%
τ²-bench (agent-taken) 26.6%
Terminal-Bench (agent-taken) 4.9%

Prestaties (gemeten)

Output-snelheid88.1 tokens/sec
Time-to-first-token (latency)0.62 sec
Snelheidsbrongemeten (Artificial Analysis)

Design Arena (ELO)

Geen Design Arena-data voor dit model.

Technische specificaties

Model-IDmeta-llama/llama-3.3-70b-instruct
Contextvenster131.072 tokens
Kennis bijgewerkt tot2023-12-31
Uitgebracht6 dec 2024
Invoertekst
Redeneren (reasoning)nee
Populariteitsscore51/100
Databronnenopenrouter, artificial_analysis, lmarena
Bekijk op OpenRouter