DeepSeek V4 Flash
DeepSeek V4 Flash ist die effizienzoptimierte Variante aus der V4-Familie: Hybrid-Attention-MoE mit 284 Milliarden Gesamtparametern, von denen pro Token nur 13 Milliarden aktiv sind. Das Modell arbeitet mit einem Kontextfenster von einer Million Tokens, unterstützt drei Reasoning-Modi und ist unter MIT-Lizenz als Open-Weight-Modell lokal betreibbar. Die chinesische Hersteller-Jurisdiktion erfordert bei Cloud-Nutzung eine separate Bewertung.
- Open Weights
- Frontier
- OR
- Text
- Long Context
- Real-Time
Sovereign Risk: HIGH DeepSeek ist ein chinesisches Unternehmen und unterliegt dem chinesischen National Security Law (NSL), das staatlichen Zugriff auf Daten und Modelle ermöglichen kann. Das BSI hat am 04.02.2025 explizit vor dem Einsatz des DeepSeek-Cloud-Dienstes gewarnt: Nutzerdaten werden auf chinesischen Servern gespeichert; eine Nutzung für dienstliche oder sensible Daten wird nicht empfohlen. Für den Cloud-API-Betrieb gilt diese Warnung uneingeschränkt.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 74.57
- Routine
- 46.11
- Reasoning
- 28.45
- LLM Judge Avg
- 3.74 / 5
- 100 Coverage
- Avg Task Duration
- 19.46s
- Real-Time
- Token Rate
- 44.04tok/s
- Output Rate
- P95 Latency
- 69.14s
- Top 5 %
- Total Tokens
- 80000
- Output Volume
- Cost per 1K
- $0.0003
- USD / 1K Requests
- Benchmark Cost
- $0.02
- Total · 80000 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian