DeepSeek R1 Distill Qwen 1.5B
Eineinhalb Milliarden Parameter, destilliert auf Qwen 2.5-Basis: DeepSeek-R1-Distill-Qwen-1.5B bringt das Reasoning-Verhalten der großen R1-Modelle in die Nano-Klasse. MIT-Lizenz, lokal als Unsloth-GGUF betreibbar, gedacht für Reasoning-Aufgaben statt Chat-Politur.
- Open Weights
- Nano
- llama.cpp
- Text
- Instruction-Tuned
- Interactive
Sovereign Risk: MEDIUM TODO
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Standard
- 35.41
- Routine
- 22.17
- Reasoning
- 13.24
- LLM Judge Avg
- 1.29 / 5
- 100 Coverage
- Avg Task Duration
- 33.58s
- Interactive
- Token Rate
- 110.25tok/s
- Output Rate
- P95 Latency
- 234.5s
- Top 5 %
- Total Tokens
- 176000
- Output Volume
- Cost per 1K
- $0
- USD / 1K Requests
- Benchmark Cost
- $0
- Total · 176000 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
DeepSeek R1 Distill Qwen 1.5B
Bestes Modell
Ø Alle Modelle
Code Quality
31.4
CLI Benchmark
45.01
Logical Reasoning
33.43
UX Writing
31.05
Documentation
35.4
Content Transform.
40.15
Cultural Intelligence
36.2
Synthesis Quality
Tool Execution
ToolUse Score
Benchmark Cost
$0
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian