Qwen 3.8 Omni Flash
Eine Million Tokens Kontext für Text, Bild, Audio und Video in einem Modell: Qwen3.8-Omni-Flash (ab 18. September 2026) ist Alibabas erstes omni-modales Modell mit agentischem Fokus — es versteht mehrstündiges Audio- und Videomaterial, plant Aufgaben und führt sie per Tool-Calling aus. Bei 0,15 / 0,47 USD pro Million Tokens senkt es die Audio-Kosten laut Alibaba um über 98 Prozent gegenüber dem Vorgänger. Output ist reiner Text, die Gewichte bleiben geschlossen.
- Proprietär
- Frontier
- OpenRouter
- Text
- Vision
- Unusable
Sovereign Risk: MEDIUM-HIGH Das Modell wird von einem chinesischen Unternehmen entwickelt und ausschließlich über Cloud-APIs bereitgestellt (Weights werden nicht veröffentlicht). Als chinesisches Unternehmen unterliegt Alibaba den PRC-Datensicherheits- und Cybersicherheitsgesetzen, nicht dem US-CLOUD-Act. Da keine Gewichte verteilt werden, besteht kein Weitergabe-Risiko, jedoch potenzielles Datenzugriffsrisiko durch chinesische Behörden bei über Alibaba-Cloud-Regionen verarbeiteten Daten.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 75.27
- Routine
- 45.9
- Reasoning
- 29.37
- LLM Judge Avg
- 3.76 / 5
- 100 Coverage
- Avg Task Duration
- 165.38s
- Unusable
- Token Rate
- 42.07tok/s
- Output Rate
- P95 Latency
- 479.21s
- Top 5 %
- Total Tokens
- 410500
- Output Volume
- Cost per 1K
- $0.0005
- USD / 1K Requests
- Benchmark Cost
- $0.19
- Total · 410500 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian