Qwen3.8-2.4T-A95B

Qwen3.8-2.4T-A95B ist Alibabas erste Open-Weights-Veröffentlichung auf Qwen-Max-Niveau (12. August 2026), ein fein granulare Mixture-of-Experts-Modell mit 2,4 Billionen Gesamt- und 95 Milliarden aktiven Parametern pro Token. Lizenz: eigene ‘Qwen3.8-Max License’. Das Modell verarbeitet Text in 262.144 Tokens Kontext (erweiterbar auf rund eine Million) bei verpflichtendem Reasoning-Modus (low/high/xhigh) und Hybrid-Attention aus Gated-DeltaNet plus Gated-Attention.

Qwen Version 3.8 Kommerzielle Nutzung erlaubt MoE 2400 B (95 B aktiv) 262 K Context $2 / $6 per 1M

  • Open Weights
  • Frontier
  • OpenRouter
  • Text
  • Long Context
  • Agentic Orchestrator
  • Batch

Sovereign Risk: HIGH Das Modell wird vom Qwen Team bei Alibaba Cloud entwickelt, einem Unternehmen mit Sitz in China. Aufgrund der chinesischen Gesetzgebung (u.a. National Security Law) und der damit verbundenen potenziellen staatlichen Einflussnahme auf Technologiefirmen wird das Herkunftsrisiko der Gewichte als hoch eingestuft, unabhängig vom Deployment-Ort.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
67.23
Routine
39.91
Reasoning
27.31

Rank #78

LLM Judge Avg
3.43
100 Coverage
Avg Task Duration
73.94
Batch
Token Rate
45.14
Output Rate
P95 Latency
239.68
Top 5 %
Total Tokens
315700
Output Volume
Cost per 1K
$0.006
USD / 1K Requests
Benchmark Cost
$1.89
Total · 315700 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Qwen3.8-2.4T-A95B Bestes Modell Ø Alle Modelle
Code Quality 61.8
CLI Benchmark 84.34
Logical Reasoning 67.17
UX Writing 53.27
Documentation 46.12
Content Transform. 77.83
Cultural Intelligence 77.84
Synthesis Quality 66.67
Tool Execution 90
ToolUse Score 78
Benchmark Cost $1.89

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil