Xiaomi MiMo V2.6 Flash

Der kleinere Bruder der MiMo-V2.6-Reihe setzt auf Effizienz statt Maximalgröße: MiMo-V2.6-Flash-RL von Xiaomi aktiviert rund 15 Milliarden von 309 Milliarden Parametern pro Token und trifft dabei bei Agenten- und Coding-Aufgaben fast das Flaggschiff Pro, zu rund einem Drittel der API-Preise. Omnimodal für Text, Bild, Video und Audio, Kontext bis 1 Million Tokens, offene Gewichte unter MIT-Lizenz.

Xiaomi Version V2.6-Flash Kommerzielle Nutzung erlaubt MoE 309 B (15 B aktiv) 1024 K Context $0.14 / $0.28 per 1M

  • Open Weights
  • Server
  • OpenRouter
  • Text
  • Vision
  • Video
  • Audio
  • Agentic Orchestrator
  • Long Context
  • Interactive

Sovereign Risk: MEDIUM Xiaomi veröffentlicht MiMo-V2.6-Flash-RL unter MIT mit vollständig offenen Gewichten, was die operative Provenienz für lokalen Betrieb stark verbessert. Als chinesischer Entwickler bleibt Xiaomi jedoch an nationale Gesetze (u.a. National Intelligence Law, Data Security Law) gebunden, was bei Nutzung über die Xiaomi-eigene API-Plattform relevant bleibt; bei rein lokalem Self-Hosting reduziert sich das operative Risiko deutlich.[434][445]

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
75.04
Routine
45.33
Reasoning
29.71

Rank #33

LLM Judge Avg
3.79
100 Coverage
Avg Task Duration
41.55
Interactive
Token Rate
43.24
Output Rate
P95 Latency
121.74
Top 5 %
Total Tokens
117400
Output Volume
Cost per 1K
$0.0003
USD / 1K Requests
Benchmark Cost
$0.03
Total · 117400 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Xiaomi MiMo V2.6 Flash Bestes Modell Ø Alle Modelle
Code Quality 78.16
CLI Benchmark 90.67
Logical Reasoning 75.64
UX Writing 69.87
Documentation 79.75
Content Transform. 70
Cultural Intelligence 70.64
Synthesis Quality 59.17
Tool Execution 90
ToolUse Score 73.42
Benchmark Cost $0.03

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil