Qwen 3.8 27B (Thinking)
Qwen3.8-27B ist Alibabas dichte 27,8-Milliarden-Parameter-Variante der Qwen3.8-Familie (14. August 2026), nativ multimodal mit Vision-Encoder für Text, Bild und Video unter Apache-2.0-Lizenz. Die 64-Layer-Hybrid-Architektur aus Gated-DeltaNet- plus Gated-Attention-Blöcken plus Multi-Token-Prediction liefert 262.144 Tokens Kontext (erweiterbar auf rund eine Million via YaRN), konfigurierbares Reasoning (xhigh/medium/low) und optionalen No-Thinking-Modus.
- Open Weights
- Workstation
- vLLM
- Text
- Vision
- Video
- Instruction-Tuned
- Long Context
- Batch
Sovereign Risk: MEDIUM Das Modell wurde von Alibaba entwickelt, einem Unternehmen mit Sitz in China. Dies birgt ein theoretisches Risiko aufgrund der chinesischen Gesetzgebung. Da die Gewichte jedoch unter der permissiven Apache-2.0-Lizenz veröffentlicht wurden und für den lokalen Einsatz vorgesehen sind, erfolgt keine Datenübertragung an den Hersteller. Das Risiko wird als ‘mittel’ eingestuft: Der Ursprung liegt in einer Hochrisiko-Jurisdiktion, aber die offene Lizenz und die lokale Nutzung minimieren das praktische Risiko erheblich.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 77.44
- Routine
- 47.15
- Reasoning
- 30.29
- LLM Judge Avg
- 3.93 / 5
- 100 Coverage
- Avg Task Duration
- 99.87s
- Batch
- Token Rate
- 22.62tok/s
- Output Rate
- P95 Latency
- 254.1s
- Top 5 %
- Total Tokens
- 136300
- Output Volume
- Cost per 1K
- $0
- USD / 1K Requests
- Benchmark Cost
- $0
- Total · 136300 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian