Qwen3.8-2.4T-A95B

Qwen3.8-2.4T-A95B ist Alibabas erste Open-Weights-Veröffentlichung auf Qwen-Max-Niveau (12. August 2026), ein fein granulare Mixture-of-Experts-Modell mit 2,4 Billionen Gesamt- und 95 Milliarden aktiven Parametern pro Token. Lizenz: eigene ‘Qwen3.8-Max License’. Das Modell verarbeitet Text in 262.144 Tokens Kontext (erweiterbar auf rund eine Million) bei verpflichtendem Reasoning-Modus (low/high/xhigh) und Hybrid-Attention aus Gated-DeltaNet plus Gated-Attention.

Alibaba Version 3.8 Kommerzielle Nutzung erlaubt MoE 2400 B (95 B aktiv) 262 K Context $2 / $6 per 1M

  • Open Weights
  • Frontier
  • OpenRouter
  • Text
  • Long Context
  • Agentic Orchestrator
  • Unusable

Sovereign Risk: HIGH Das Modell wird vom Qwen Team bei Alibaba Cloud entwickelt, einem Unternehmen mit Sitz in China. Aufgrund der chinesischen Gesetzgebung (u.a. National Security Law) und der damit verbundenen potenziellen staatlichen Einflussnahme auf Technologiefirmen wird das Herkunftsrisiko der Gewichte als hoch eingestuft, unabhängig vom Deployment-Ort.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
76.48
Routine
46.82
Reasoning
29.67

Rank #23

LLM Judge Avg
3.79
100 Coverage
Avg Task Duration
121.65
Unusable
Token Rate
95.04
Output Rate
P95 Latency
445.42
Top 5 %
Total Tokens
370700
Output Volume
Cost per 1K
$0.006
USD / 1K Requests
Benchmark Cost
$2.22
Total · 370700 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Qwen3.8-2.4T-A95B Bestes Modell Ø Alle Modelle
Code Quality 82.04
CLI Benchmark 86.67
Logical Reasoning 69.8
UX Writing 72.79
Documentation 72.51
Content Transform. 77.35
Cultural Intelligence 74.64
Synthesis Quality 66.67
Tool Execution 90
ToolUse Score 81.17
Benchmark Cost $2.22

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil