DeepSeek V4 Flash

DeepSeek V4 Flash ist die effizienzoptimierte Variante aus der V4-Familie: Hybrid-Attention-MoE mit 284 Milliarden Gesamtparametern, von denen pro Token nur 13 Milliarden aktiv sind. Das Modell arbeitet mit einem Kontextfenster von einer Million Tokens, unterstützt drei Reasoning-Modi und ist unter MIT-Lizenz als Open-Weight-Modell lokal betreibbar. Die chinesische Hersteller-Jurisdiktion erfordert bei Cloud-Nutzung eine separate Bewertung.

DeepSeek Version 4 Kommerzielle Nutzung erlaubt MoE 284 B (13 B aktiv) 1000 K Context 05/2025 $0.0795 / $0.159 per 1M

  • Open Weights
  • Frontier
  • OpenRouter
  • Text
  • Long Context
  • Interactive

Sovereign Risk: HIGH DeepSeek ist ein chinesisches Unternehmen und unterliegt dem chinesischen National Security Law (NSL), das staatlichen Zugriff auf Daten und Modelle ermöglichen kann. Das BSI hat am 04.02.2025 explizit vor dem Einsatz des DeepSeek-Cloud-Dienstes gewarnt: Nutzerdaten werden auf chinesischen Servern gespeichert; eine Nutzung für dienstliche oder sensible Daten wird nicht empfohlen. Für den Cloud-API-Betrieb gilt diese Warnung uneingeschränkt.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
72.87
Routine
44.59
Reasoning
28.29

Rank #50

LLM Judge Avg
3.67
100 Coverage
Avg Task Duration
33.01
Interactive
Token Rate
29.95
Output Rate
P95 Latency
99.56
Top 5 %
Total Tokens
87700
Output Volume
Cost per 1K
$0.0002
USD / 1K Requests
Benchmark Cost
$0.01
Total · 87700 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

DeepSeek V4 Flash Bestes Modell Ø Alle Modelle
Code Quality 71.4
CLI Benchmark 86.67
Logical Reasoning 70.81
UX Writing 65.63
Documentation 68.73
Content Transform. 78.6
Cultural Intelligence 71.72
Synthesis Quality 66.67
Tool Execution 90
ToolUse Score 77.5
Benchmark Cost $0.01

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil