Llama 3.3 70B Versatile

Llama 3.3 70B Versatile ist Metas Allround-Modell der 70-Milliarden-Klasse mit ausgewogenen Stärken über ein breites Aufgabenspektrum. Mit 128.000 Tokens Kontextfenster und offenen Gewichten unter der Llama-3.3-Community-Lizenz ist das Modell wahlweise lokal für maximale Datensouveränität oder über Cloud-Anbieter verfügbar.

Meta Version 3.3-70B Kommerzielle Nutzung erlaubt Dense 70 B 128 K Context 12/2024 $0.59 / $0.79 per 1M

  • Restricted Weights
  • Server
  • GR
  • Text
  • Instruction-Tuned
  • Real-Time

Sovereign Risk: MEDIUM Meta ist ein US-Unternehmen; die Gewichte sind öffentlich zugänglich, und lokaler Betrieb vermeidet API-Datenabfluss.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Bronze
64.32
Routine
39.42
Reasoning
24.9

Rank #88

LLM Judge Avg
3.24
100 Coverage
Avg Task Duration
1.75
Real-Time
Token Rate
275.73
Output Rate
P95 Latency
3.32
Top 5 %
Total Tokens
40800
Output Volume
Cost per 1K
$0.0008
USD / 1K Requests
Benchmark Cost
$0.03
Total · 40800 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Llama 3.3 70B Versatile Bestes Modell Ø Alle Modelle
Code Quality 60.8
CLI Benchmark 79.67
Logical Reasoning 64.64
UX Writing 61.79
Documentation 50.37
Content Transform. 68.77
Cultural Intelligence 74.64
Synthesis Quality 31.67
Tool Execution 53.33
ToolUse Score 42.33
Benchmark Cost $0.03

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil