Qwen3.8-2.4T-A95B
Qwen3.8-2.4T-A95B ist Alibabas erste Open-Weights-Veröffentlichung auf Qwen-Max-Niveau (12. August 2026), ein fein granulare Mixture-of-Experts-Modell mit 2,4 Billionen Gesamt- und 95 Milliarden aktiven Parametern pro Token. Lizenz: eigene ‘Qwen3.8-Max License’. Das Modell verarbeitet Text in 262.144 Tokens Kontext (erweiterbar auf rund eine Million) bei verpflichtendem Reasoning-Modus (low/high/xhigh) und Hybrid-Attention aus Gated-DeltaNet plus Gated-Attention.
- Open Weights
- Frontier
- OpenRouter
- Text
- Long Context
- Agentic Orchestrator
- Batch
Sovereign Risk: HIGH Das Modell wird vom Qwen Team bei Alibaba Cloud entwickelt, einem Unternehmen mit Sitz in China. Aufgrund der chinesischen Gesetzgebung (u.a. National Security Law) und der damit verbundenen potenziellen staatlichen Einflussnahme auf Technologiefirmen wird das Herkunftsrisiko der Gewichte als hoch eingestuft, unabhängig vom Deployment-Ort.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 67.23
- Routine
- 39.91
- Reasoning
- 27.31
- LLM Judge Avg
- 3.43 / 5
- 100 Coverage
- Avg Task Duration
- 73.94s
- Batch
- Token Rate
- 45.14tok/s
- Output Rate
- P95 Latency
- 239.68s
- Top 5 %
- Total Tokens
- 315700
- Output Volume
- Cost per 1K
- $0.006
- USD / 1K Requests
- Benchmark Cost
- $1.89
- Total · 315700 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian