DeepSeek R1 Distill Qwen 1.5B

Eineinhalb Milliarden Parameter, destilliert auf Qwen 2.5-Basis: DeepSeek-R1-Distill-Qwen-1.5B bringt das Reasoning-Verhalten der großen R1-Modelle in die Nano-Klasse. MIT-Lizenz, lokal als Unsloth-GGUF betreibbar, gedacht für Reasoning-Aufgaben statt Chat-Politur.

DeepSeek Version 1 Kommerzielle Nutzung erlaubt Dense 1.5 B (1.5 B aktiv) 06/2024 local getestet

  • Open Weights
  • Nano
  • llama.cpp
  • Text
  • Instruction-Tuned
  • Interactive

Sovereign Risk: MEDIUM TODO

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Standard
35.41
Routine
22.17
Reasoning
13.24

Rank #103

LLM Judge Avg
1.29
100 Coverage
Avg Task Duration
33.58
Interactive
Token Rate
110.25
Output Rate
P95 Latency
234.5
Top 5 %
Total Tokens
176000
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 176000 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

DeepSeek R1 Distill Qwen 1.5B Bestes Modell Ø Alle Modelle
Code Quality 31.4
CLI Benchmark 45.01
Logical Reasoning 33.43
UX Writing 31.05
Documentation 35.4
Content Transform. 40.15
Cultural Intelligence 36.2
Synthesis Quality
Tool Execution
ToolUse Score
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil