DeepSeek V4.1 Flash
DeepSeek V4.1 Flash ist die kompakte Variante der DeepSeek-V4.1-Familie mit 552 Mrd. Gesamtparametern und 16 Mrd. aktiven Parametern pro Token. Das Modell wird unter der MIT-Lizenz als offene Gewichte mit Bild- und Textverarbeitung veröffentlicht. Sein 1-Million-Token-Kontextfenster ist für lange Agenten-Workflows ausgelegt, erfordert aber aufgrund seiner Größe eine Server-Infrastruktur für den lokalen Betrieb.
- Open Weights
- Server
- OpenRouter
- Text
- Vision
- Agentic Orchestrator
- Long Context
- Batch
Sovereign Risk: HIGH Obwohl DeepSeek V4.1 Flash als Open-Weight-Modell unter der permissiven MIT-Lizenz veröffentlicht wird, ist der Entwickler DeepSeek ein in China ansässiges Unternehmen. Die chinesische Jurisdiktion birgt ein hohes Souveränitäts- und Compliance-Risiko, insbesondere bei der Nutzung von Cloud-Diensten, die dem chinesischen Recht unterliegen.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 73.55
- Routine
- 44.63
- Reasoning
- 28.92
- LLM Judge Avg
- 3.66 / 5
- 100 Coverage
- Avg Task Duration
- 49.22s
- Batch
- Token Rate
- 112.43tok/s
- Output Rate
- P95 Latency
- 173.19s
- Top 5 %
- Total Tokens
- 199100
- Output Volume
- Cost per 1K
- $0.0006
- USD / 1K Requests
- Benchmark Cost
- $0.12
- Total · 199100 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian