Qwen 3.6 27B NVFP4 (vLLM, Dense, MTP) (Thinking)
Qwen 3.6 27B ist Alibabas dichtes Open-Weights-Modell mit 27,8 Mrd. aktiven Parametern, das laut Hersteller das eigene MoE-Geschwistermodell 35B-A3B in Coding-, Agent- und Vision-Tests übertrifft. Veröffentlicht am 22. April 2026 unter Apache 2.0 für lokalen Betrieb, kombiniert die Architektur hybride Attention mit nativer Multi-Token-Prediction für spürbaren Durchsatz.
- Open Weights
- Workstation
- VSPK
- Text
- Vision
- Video
- Instruction-Tuned
- Unusable
Sovereign Risk: MEDIUM Der Entwickler Alibaba hat seinen Hauptsitz in China, was bei der Nutzung von Cloud-Diensten des Herstellers ein potenzielles Risiko im Hinblick auf die chinesische Gesetzgebung (NSL) darstellt. Da die Modellgewichte jedoch unter der Apache-2.0-Lizenz offen verfügbar sind und dieses Modell für den rein lokalen Betrieb konzipiert ist, findet keine Datenübertragung an Server des Herstellers statt. Das Risiko wird daher als ‘mittel’ eingestuft, da der Ursprung in einer Hochrisiko-Jurisdiktion liegt, die praktische Gefahr bei lokaler Nutzung aber minimiert ist.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 71.71
- Routine
- 43.57
- Reasoning
- 28.13
- LLM Judge Avg
- 3.66 / 5
- 100 Coverage
- Avg Task Duration
- 203.85s
- Unusable
- Token Rate
- 8.51tok/s
- Output Rate
- P95 Latency
- 364.98s
- Top 5 %
- Total Tokens
- 204000
- Output Volume
- Cost per 1K
- $0
- USD / 1K Requests
- Benchmark Cost
- $0
- Total · 204000 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian