DeepSeek V4.1 Flash

DeepSeek V4.1 Flash ist die kompakte Variante der DeepSeek-V4.1-Familie mit 552 Mrd. Gesamtparametern und 16 Mrd. aktiven Parametern pro Token. Das Modell wird unter der MIT-Lizenz als offene Gewichte mit Bild- und Textverarbeitung veröffentlicht. Sein 1-Million-Token-Kontextfenster ist für lange Agenten-Workflows ausgelegt, erfordert aber aufgrund seiner Größe eine Server-Infrastruktur für den lokalen Betrieb.

DeepSeek Version 4.1 Kommerzielle Nutzung erlaubt MoE 552 B (16 B aktiv) 1000 K Context 09/2026 $0.15 / $0.6 per 1M

  • Open Weights
  • Server
  • OpenRouter
  • Text
  • Vision
  • Agentic Orchestrator
  • Long Context
  • Batch

Sovereign Risk: HIGH Obwohl DeepSeek V4.1 Flash als Open-Weight-Modell unter der permissiven MIT-Lizenz veröffentlicht wird, ist der Entwickler DeepSeek ein in China ansässiges Unternehmen. Die chinesische Jurisdiktion birgt ein hohes Souveränitäts- und Compliance-Risiko, insbesondere bei der Nutzung von Cloud-Diensten, die dem chinesischen Recht unterliegen.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
73.55
Routine
44.63
Reasoning
28.92

Rank #39

LLM Judge Avg
3.66
100 Coverage
Avg Task Duration
49.22
Batch
Token Rate
112.43
Output Rate
P95 Latency
173.19
Top 5 %
Total Tokens
199100
Output Volume
Cost per 1K
$0.0006
USD / 1K Requests
Benchmark Cost
$0.12
Total · 199100 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

DeepSeek V4.1 Flash Bestes Modell Ø Alle Modelle
Code Quality 82.04
CLI Benchmark 89
Logical Reasoning 68.42
UX Writing 66.15
Documentation 62.86
Content Transform. 73.68
Cultural Intelligence 78.12
Synthesis Quality 63.33
Tool Execution 90
ToolUse Score 75.83
Benchmark Cost $0.12

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil