Llama 3.3 70B Versatile
Llama 3.3 70B Versatile ist Metas Allround-Modell der 70-Milliarden-Klasse mit ausgewogenen Stärken über ein breites Aufgabenspektrum. Mit 128.000 Tokens Kontextfenster und offenen Gewichten unter der Llama-3.3-Community-Lizenz ist das Modell wahlweise lokal für maximale Datensouveränität oder über Cloud-Anbieter verfügbar.
- Restricted Weights
- Server
- GR
- Text
- Instruction-Tuned
- Real-Time
Sovereign Risk: MEDIUM Meta ist ein US-Unternehmen; die Gewichte sind öffentlich zugänglich, und lokaler Betrieb vermeidet API-Datenabfluss.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Bronze
- 64.32
- Routine
- 39.42
- Reasoning
- 24.9
- LLM Judge Avg
- 3.24 / 5
- 100 Coverage
- Avg Task Duration
- 1.75s
- Real-Time
- Token Rate
- 275.73tok/s
- Output Rate
- P95 Latency
- 3.32s
- Top 5 %
- Total Tokens
- 40800
- Output Volume
- Cost per 1K
- $0.0008
- USD / 1K Requests
- Benchmark Cost
- $0.03
- Total · 40800 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian