Xiaomi MiMo V2.6 Flash
Der kleinere Bruder der MiMo-V2.6-Reihe setzt auf Effizienz statt Maximalgröße: MiMo-V2.6-Flash-RL von Xiaomi aktiviert rund 15 Milliarden von 309 Milliarden Parametern pro Token und trifft dabei bei Agenten- und Coding-Aufgaben fast das Flaggschiff Pro, zu rund einem Drittel der API-Preise. Omnimodal für Text, Bild, Video und Audio, Kontext bis 1 Million Tokens, offene Gewichte unter MIT-Lizenz.
- Open Weights
- Server
- OpenRouter
- Text
- Vision
- Video
- Audio
- Agentic Orchestrator
- Long Context
- Interactive
Sovereign Risk: MEDIUM Xiaomi veröffentlicht MiMo-V2.6-Flash-RL unter MIT mit vollständig offenen Gewichten, was die operative Provenienz für lokalen Betrieb stark verbessert. Als chinesischer Entwickler bleibt Xiaomi jedoch an nationale Gesetze (u.a. National Intelligence Law, Data Security Law) gebunden, was bei Nutzung über die Xiaomi-eigene API-Plattform relevant bleibt; bei rein lokalem Self-Hosting reduziert sich das operative Risiko deutlich.[434][445]
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 75.04
- Routine
- 45.33
- Reasoning
- 29.71
- LLM Judge Avg
- 3.79 / 5
- 100 Coverage
- Avg Task Duration
- 41.55s
- Interactive
- Token Rate
- 43.24tok/s
- Output Rate
- P95 Latency
- 121.74s
- Top 5 %
- Total Tokens
- 117400
- Output Volume
- Cost per 1K
- $0.0003
- USD / 1K Requests
- Benchmark Cost
- $0.03
- Total · 117400 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian