Qwen 3.8 Omni Flash

Eine Million Tokens Kontext für Text, Bild, Audio und Video in einem Modell: Qwen3.8-Omni-Flash (ab 18. September 2026) ist Alibabas erstes omni-modales Modell mit agentischem Fokus — es versteht mehrstündiges Audio- und Videomaterial, plant Aufgaben und führt sie per Tool-Calling aus. Bei 0,15 / 0,47 USD pro Million Tokens senkt es die Audio-Kosten laut Alibaba um über 98 Prozent gegenüber dem Vorgänger. Output ist reiner Text, die Gewichte bleiben geschlossen.

Alibaba Version 3.8 Kommerzielle Nutzung erlaubt Dense 1000 K Context $0.15 / $0.47 per 1M

  • Proprietär
  • Frontier
  • OpenRouter
  • Text
  • Vision
  • Unusable

Sovereign Risk: MEDIUM-HIGH Das Modell wird von einem chinesischen Unternehmen entwickelt und ausschließlich über Cloud-APIs bereitgestellt (Weights werden nicht veröffentlicht). Als chinesisches Unternehmen unterliegt Alibaba den PRC-Datensicherheits- und Cybersicherheitsgesetzen, nicht dem US-CLOUD-Act. Da keine Gewichte verteilt werden, besteht kein Weitergabe-Risiko, jedoch potenzielles Datenzugriffsrisiko durch chinesische Behörden bei über Alibaba-Cloud-Regionen verarbeiteten Daten.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
75.27
Routine
45.9
Reasoning
29.37

Rank #33

LLM Judge Avg
3.76
100 Coverage
Avg Task Duration
165.38
Unusable
Token Rate
42.07
Output Rate
P95 Latency
479.21
Top 5 %
Total Tokens
410500
Output Volume
Cost per 1K
$0.0005
USD / 1K Requests
Benchmark Cost
$0.19
Total · 410500 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Qwen 3.8 Omni Flash Bestes Modell Ø Alle Modelle
Code Quality 81.76
CLI Benchmark 85
Logical Reasoning 68.95
UX Writing 73.31
Documentation 71.68
Content Transform. 70.81
Cultural Intelligence 77.84
Synthesis Quality 66.67
Tool Execution 90
ToolUse Score 77.67
Benchmark Cost $0.19

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil