Qwen3.8-Flash

Qwen3.8 Flash ist Alibabas cloud-only Multimodal-Reasoning-Modell mit einer Million Tokens Kontext und 0,16 / 0,47 USD pro Million Tokens. Verarbeitet Text, Bild und Video mit Tool Calling, erreichbar über Alibaba Cloud und OpenRouter. Die offene Basis Qwen3.8-Flash-Next ist verfügbar, der getestete Build ist Cloud-only. Architektur und Parameteranzahl sind nicht offengelegt, Daten laufen über chinesische Jurisdiktion.

Alibaba Version 3.8-Flash Kommerzielle Nutzung erlaubt Dense 1024 K Context $0.16 / $0.47 per 1M

  • Open Weights
  • Frontier
  • OpenRouter
  • Text
  • Vision
  • Video
  • Agentic Orchestrator
  • Long Context
  • Interactive

Sovereign Risk: MEDIUM Basis-Gewichte sind offen verfuegbar (Qwen/Qwen3.8-Flash-Next, qwen-community-1.0, offizielle NVFP4/GGUF/FP8-Quants) — lokales Deployment moeglich. Der getestete OpenRouter-Endpoint ist jedoch Alibabas Produktions-Build (Qwen3.8-Flash, 1M Kontext, built-in Tools), dessen exakte Post-Training-Differenzen zu Flash-Next nicht offengelegt sind. Entwicklung/Betrieb unterliegen chinesischer Jurisdiktion.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
79.51
Routine
48.19
Reasoning
31.31

Rank #5

LLM Judge Avg
4.02
100 Coverage
Avg Task Duration
39.68
Interactive
Token Rate
50.94
Output Rate
P95 Latency
88.89
Top 5 %
Total Tokens
113600
Output Volume
Cost per 1K
$0.0005
USD / 1K Requests
Benchmark Cost
$0.05
Total · 113600 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Qwen3.8-Flash Bestes Modell Ø Alle Modelle
Code Quality 87.64
CLI Benchmark 93
Logical Reasoning 75.52
UX Writing 76.07
Documentation 84.16
Content Transform. 72.37
Cultural Intelligence 78.12
Synthesis Quality 62.5
Tool Execution 90
ToolUse Score 75.92
Benchmark Cost $0.05

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil