Qwen 3.6 35B-A3B (Unsloth) (Thinking)

Qwen 3.6 35B-A3B ist Alibabas MoE-Modell mit 35 Mrd. Gesamt- und rund 3 Mrd. aktiven Parametern pro Token, veröffentlicht am 22. April 2026 unter Apache 2.0 mit offenen Gewichten für lokalen Betrieb. Die hybride Attention-Architektur kombiniert klassische Aufmerksamkeit mit linearer Variante, Multi-Token-Prediction beschleunigt die Generierung spürbar.

Alibaba Version 3.6 Kommerzielle Nutzung erlaubt MoE 35 B (3 B aktiv) 262 K Context 12/2025 local getestet

  • Open Weights
  • Workstation
  • vLLM
  • Text
  • Vision
  • Video
  • Instruction-Tuned
  • Interactive

Sovereign Risk: MEDIUM Das Modell stammt vom Qwen-Team (Alibaba), das in China ansässig ist. Die Einstufung des Risikos als ‘mittel’ statt ‘hoch’ berücksichtigt, dass es sich um ein Open-Source-Modell unter permissiver Apache-2.0-Lizenz handelt, das vollständig lokal ohne Cloud-Verbindung zu Alibaba-Servern betrieben werden kann. Bei rein lokalem Betrieb entfällt die NSL-Relevanz praktisch vollständig, ein theoretisches Restrisiko aufgrund der chinesischen Entwickler-Jurisdiktion bleibt für die Herkunftsbewertung bestehen.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
74.07
Routine
44.92
Reasoning
29.15

Rank #34

LLM Judge Avg
3.65
100 Coverage
Avg Task Duration
44.5
Interactive
Token Rate
84.59
Output Rate
P95 Latency
74.3
Top 5 %
Total Tokens
220800
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 220800 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Qwen 3.6 35B-A3B (Unsloth) (Thinking) Bestes Modell Ø Alle Modelle
Code Quality 70.64
CLI Benchmark 67.67
Logical Reasoning 74.17
UX Writing 73.07
Documentation 74.78
Content Transform. 81.98
Cultural Intelligence 70.4
Synthesis Quality 56.67
Tool Execution 83.33
ToolUse Score 76.62
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil