DeepSeek V4 Flash

DeepSeek V4 Flash ist die effizienzoptimierte Variante aus der V4-Familie: Hybrid-Attention-MoE mit 284 Milliarden Gesamtparametern, von denen pro Token nur 13 Milliarden aktiv sind. Das Modell arbeitet mit einem Kontextfenster von einer Million Tokens, unterstützt drei Reasoning-Modi und ist unter MIT-Lizenz als Open-Weight-Modell lokal betreibbar. Die chinesische Hersteller-Jurisdiktion erfordert bei Cloud-Nutzung eine separate Bewertung.

DeepSeek Version 4 Kommerzielle Nutzung erlaubt MoE 284 B (13 B aktiv) 1000 K Context 05/2025 $0.14 / $0.28 per 1M

  • Open Weights
  • Frontier
  • OR
  • Text
  • Long Context
  • Real-Time

Sovereign Risk: HIGH DeepSeek ist ein chinesisches Unternehmen und unterliegt dem chinesischen National Security Law (NSL), das staatlichen Zugriff auf Daten und Modelle ermöglichen kann. Das BSI hat am 04.02.2025 explizit vor dem Einsatz des DeepSeek-Cloud-Dienstes gewarnt: Nutzerdaten werden auf chinesischen Servern gespeichert; eine Nutzung für dienstliche oder sensible Daten wird nicht empfohlen. Für den Cloud-API-Betrieb gilt diese Warnung uneingeschränkt.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
74.57
Routine
46.11
Reasoning
28.45

Rank #23

LLM Judge Avg
3.74
100 Coverage
Avg Task Duration
19.46
Real-Time
Token Rate
44.04
Output Rate
P95 Latency
69.14
Top 5 %
Total Tokens
80000
Output Volume
Cost per 1K
$0.0003
USD / 1K Requests
Benchmark Cost
$0.02
Total · 80000 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

DeepSeek V4 Flash Bestes Modell Ø Alle Modelle
Code Quality 70.48
CLI Benchmark 90.67
Logical Reasoning 69.75
UX Writing 71.95
Documentation 75.06
Content Transform. 78.36
Cultural Intelligence 71.72
Synthesis Quality 66.67
Tool Execution 90
ToolUse Score 77.5
Benchmark Cost $0.02

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil