Qwen3.6 27B Instruct (Thinking)
Qwen3.6 27B Instruct ist Alibabas erstes dichtes Modell seit dem Qwen3.5-Wechsel zu MoE — 27,8 Milliarden Parameter, alle pro Token aktiv, ohne Sparsity-Vorteil. Das Modell ist auf Agentic Coding und Repository-weites Reasoning ausgelegt, verarbeitet Text, Bild und Video nativ, bietet 262.000 Tokens Kontext und Function-Calling. Thinking-Modus mit Reasoning-Erhaltung über mehrere Turns und Apache-2.0-Lizenz, kommerzielle Nutzung frei.
- Open Weights
- Workstation
- VSPK
- Text
- Vision
- Video
- Instruction-Tuned
- Unusable
Sovereign Risk: MEDIUM Alibaba Cloud ist ein chinesisches Unternehmen, daher potenziell chinesisches NSL-Risiko bei Cloud-/API-Nutzung über Alibaba-eigene Endpunkte. Das Modell steht unter Apache-2.0-Lizenz ohne regionale Einschränkungen, Gewichte sind offen auf Hugging Face verfügbar (BF16 und FP8-Block-Quantisierung). Bei rein lokalem Betrieb über llama.cpp/GGUF/MLX entfällt sowohl NSL- als auch US-CLOUD-Act-Relevanz vollständig, da keine Datenübertragung an Alibaba-Server erfolgt. Trainingsdaten nicht vollständig offengelegt.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 73.87
- Routine
- 45.95
- Reasoning
- 27.92
- LLM Judge Avg
- 3.81 / 5
- 100 Coverage
- Avg Task Duration
- 199.88s
- Unusable
- Token Rate
- 7.2tok/s
- Output Rate
- P95 Latency
- 396.82s
- Top 5 %
- Total Tokens
- 182000
- Output Volume
- Cost per 1K
- $0
- USD / 1K Requests
- Benchmark Cost
- $0
- Total · 182000 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian