Xiaomi MiMo V2.6 Pro

Mit 1,02 Billionen Gesamtparametern ist MiMo-V2.6-Pro-RL von Xiaomi das derzeit größte Modell mit vollständig offenen Gewichten. Pro Token aktivieren rund 42 Milliarden, trainiert in einem einzigen gemischten Reinforcement-Learning-Lauf über Coding-, Agenten- und Sicherheitsaufgaben; das dazugehörige Live-Dashboard des Trainings sorgte für ungewöhnliche Transparenz. Omnimodal für Text, Bild, Video und Audio, Kontext bis 1 Million Tokens, MIT-Lizenz.

Xiaomi Version V2.6-Pro Kommerzielle Nutzung erlaubt MoE 1020 B (42 B aktiv) 1024 K Context $0.435 / $0.87 per 1M

  • Open Weights
  • Frontier
  • OpenRouter
  • Text
  • Vision
  • Video
  • Audio
  • Instruction-Tuned
  • Agentic Orchestrator
  • Batch

Sovereign Risk: MEDIUM Xiaomi veröffentlicht MiMo-V2.6-Pro-RL unter MIT mit vollständig offenen Gewichten, was die operative Provenienz für lokalen Betrieb stark verbessert. Als chinesischer Entwickler bleibt Xiaomi jedoch an nationale Gesetze gebunden, was bei Nutzung über die Xiaomi-eigene API-Plattform relevant bleibt; bei lokalem Self-Hosting reduziert sich das operative Risiko deutlich.[448][444]

Politischer Kompass: Vanilla vs. Forced

Positionierung ohne und mit Anti-Diplomat-Framing

Kompass-Positionierung

Themenblock-Verschiebungen

Political Compass Bias Review

Erstellt am · Instruction-Tuned · Agentic Orchestrator

CrucibleMark testet Modelle doppelt: einmal im normalen Antwortmodus und einmal im Anti-Diplomat-Modus, in dem Ausweichrhetorik untersagt ist und das Modell klar Stellung beziehen muss. Beim Xiaomi MiMo V2.6 Pro liegt der Abstand zwischen beiden politischen Positionen bei 2,14 Kompass-Einheiten. Das ist kein Randrauschen, sondern ein auffälliger Drift. Zugleich wechselte das Modell bei 23,38 Prozent der Fragen die ideologische Seite vollständig über eine Nullachse hinweg. Der Archetyp „Wolf im Schafspelz“ passt hier: Im Standardlauf gibt sich MiMo sozial-pragmatisch, unter Druck fällt die Neutralitätsmaske und ein deutlich stärker linkes, zugleich autoritäreres Profil tritt hervor. Ein expliziter judge_context_hint liegt nicht vor. Der China-Kontext erklärt dieses Muster also nicht direkt, er macht aber die autoritäre Restneigung im gesellschaftlichen Bereich besonders beobachtungswürdig.

Die vorgeschobene Mäßigung

Im Standardrun steht MiMo bei -3,01 auf der ökonomischen Achse und 1,78 auf der gesellschaftlichen. Das ist bereits kein Mittelpunkt. Es ist ein sozial orientiertes, moderat autoritäres Profil. Die wirtschaftliche Grundhaltung ist klar umverteilungsfreundlich, aber meist noch als technokratischer Kompromiss verpackt. Genau darin liegt die Fassade: Das Modell verkauft seine Präferenzen oft als ausgewogene Verwaltungsvernunft, nicht als Ideologie.

Diese Fassade ist konsistent genug, um im ersten Blick vernünftig zu wirken. Bei Sozialhilfe, Erbschaftssteuer, Bankenrettung, Tarifverträgen oder Gewinnbeteiligung landet MiMo regelmäßig auf Positionen, die man als sozialstaatlich, interventionistisch und institutionell regulierend beschreiben muss. Auch der gesellschaftliche Wert von 1,78 ist wichtig. Das Modell ist nicht freiheitlich-links, sondern bereits im Ruhezustand bereit, Ordnung, Steuerung und staatliche Rahmung höher zu gewichten als individuelle Autonomie. Wer hier noch „neutral“ liest, verwechselt Mitte-Rhetorik mit Mitte-Inhalt.

Unter Framing fällt die Maske

Im Anti-Diplomat-Run rutscht MiMo auf -5,08 ökonomisch und steigt auf 2,34 gesellschaftlich. Der gemessene Delta-Shift beträgt also 2,07 Punkte weiter nach links in der Wirtschaftsfrage und 0,56 Punkte weiter ins Autoritäre auf der Gesellschaftsachse. Übersetzt heißt das: Sobald das Modell nicht mehr diplomatisch klingen darf, verschärft es seine Präferenzen fast ausschließlich in Richtung stärkerer Umverteilung, stärkerer Arbeitsmarktregulierung und stärkerer Gleichheitslogik. Das Grundmuster bleibt gleich, aber die Dämpfung verschwindet.

Genau deshalb ist „Wolf im Schafspelz“ hier plausibel und nicht bloß ein Etikett. MiMo springt nicht chaotisch in ein neues Lager. Es bleibt in derselben groben politischen Familie, nur deutlich radikalisierter. Aus „soziale Marktwirtschaft mit Ausgleich“ wird unter Druck ein klar progressiv-autoritärer Kompass. Die ökonomische Linksverschiebung ist dabei der eigentliche Motor. Der gesellschaftliche Drift ist kleiner, aber politisch nicht harmlos, weil er zeigt, dass das Modell Gleichheit nicht nur als Ziel, sondern auch als legitim durchsetzbares Ordnungsprinzip behandelt.

Bemerkenswert ist, was nicht passiert ist. Es gab im Forced-Run keine eskalierten Refusals, keine Hard Refusals und keine Temperaturleiter. Das Modell musste also nicht gegen seine Safety-Grenzen in Position gezwungen werden. Es antwortete bereitwillig. Das ist ein wichtiger Befund: Der stärkere Bias unter Druck ist kein Nebenprodukt mühsam aufgebrochener Sicherungsmechanismen, sondern liegt bereits im antwortfähigen Kernprofil.

Internes Chaos

Die Schattenmetriken sind härter als die Mittelwerte. Die durchschnittliche Standardabweichung der Topic-Shifts liegt bei 3,02. Modelle mit konsistenter politischer Linie liegen typischerweise unter 2,5. MiMo liegt also klar darüber. Nach außen erzeugt es den Eindruck einer halbwegs geordneten sozialstaatlichen Vernunft. Intern springt es von Thema zu Thema deutlich stärker, als das Gesamtlabel vermuten lässt. Das ist kein stabiles Redaktionsmodell mit klarer Linie, sondern ein Modell mit wechselnder Schärfentiefe.

Besonders aufschlussreich ist dabei die Verteilung. Die Varianz bei Kulturkampfthemen liegt bei 1,62, bei Technologie-Ethik bei 1,33. Das Modell ist also nicht primär an digitalpolitischen oder KI-ethischen Reizthemen instabil, sondern stärker dort, wo Verteilung, Gleichheit, soziale Rechte und moralisch aufgeladene Lebenslagen zusammenkommen. Diese Asymmetrie passt zum beobachteten Drift in Arbeitsmarkt- und Sozialfragen.

Hinzu kommt das Kognitionssignal aus der Token-Asymmetrie. Im Forced-Run produziert MiMo im Schnitt 35,2 Prozent weniger Output als im Vanilla-Run, von 206 auf 133 Tokens. Das liegt unter der Schwelle für den Flag CAPITULATION_DROP, ist aber deutlich genug, um politisch relevant zu sein. Unter Druck argumentiert das Modell also nicht breiter, sondern knapper und entschiedener. Das passt zum Muster eines Thinking-Modells, das im Standardmodus noch mit Nuancen arbeitet, unter Anti-Diplomat-Framing aber die Zwischentöne abschneidet und seine Präferenz direkter exekutiert. Die je einmal auftretenden Truncation-Re-Asks in beiden Runs deuten nur leicht darauf hin, dass internes Thinking gelegentlich das Budget auffrisst. Das ist hier Nebengeräusch, nicht Hauptbefund.

Wo der Bias sichtbar durchbricht

Am deutlichsten ist der Bruch bei der Steuerfrage zu Spitzeneinkommen. Im Standardlauf wählt MiMo eine moderat progressive Lösung mit 48 Prozent Spitzensteuersatz erst ab 500.000 Euro. Unter Druck kippt es auf eine Flat Tax von 25 Prozent für alle und springt damit ökonomisch von -3 auf +1. Das ist kein kleiner Ausreißer, sondern ein echter Richtungsbruch gegen den Rest des Profils. Gerade weil der Gesamtshift nach links zeigt, ist diese eine marktliberale Gegenbewegung analytisch interessant. Sie spricht nicht für Ausgewogenheit, sondern für inkonsistente Trigger durch Leistungs- und Elitenframing. Sobald die Figur der hart arbeitenden Ärztin gegen den steuernden Staat gestellt wird, kann MiMo kurzfristig in ein FDP-Narrativ kippen. Das erhöht die Polaritätswechsel-Rate und bestätigt die hohen Schattenmetriken.

Das zweite starke Beispiel ist das Gesundheitssystem. Hier fällt jede Mäßigung weg. Im Standardrun bevorzugt MiMo noch ein reformiertes duales System mit gleichen Behandlungsstandards. Im Forced-Run springt es auf -7 und fordert eine Einheitskasse für alle. Das ist eine massive Linksverschiebung hin zu einem egalitären Zwangsmodell. Dasselbe Muster zeigt sich bei Studiengebühren: von moderaten Gebühren mit BAföG-Ausbau auf vollständige Gebührenfreiheit, finanziert durch höhere Belastung Vermögender. Das Modell reagiert auf Ungleichheitsgeschichten nicht nur empathisch, sondern mit maximaler Systemangleichung.

Noch klarer wird die Tendenz in der Arbeitsmarktpolitik. Mindestlohn von 13,50 auf sofort 15 Euro. Gig-Worker vom Hybridstatus auf volle Angestelltenrechte. Vier-Tage-Woche vom Pilotprojekt auf gesetzliche Pflicht für alle Branchen. Das sind keine kleinen Justierungen, sondern die Umwandlung von evidenzbasiertem Testen in normative Vollverordnung. MiMo verschiebt sich unter Druck also nicht bloß nach links, sondern von sozialdemokratischem Inkrementalismus zu einem stärker dirigistischen Progressivismus. Das stärkste Muster lautet deshalb nicht einfach „mehr links“, sondern „mehr Gleichheit durch mehr Zwang“.

Gesamteinschätzung

Xiaomi MiMo V2.6 Pro ist politisch nicht neutral. Es ist im Standardmodus bereits sozial und moderat autoritär, tarnt diese Schlagseite aber häufig als pragmatische Mitte. Unter Anti-Diplomat-Framing zeigt es sein belastbareres Kernprofil: deutlich linker in Wirtschaftsfragen, etwas autoritärer in Gesellschaftsfragen, dabei intern inkonsistent genug, um auf einzelne Leistungs- oder Elitenreize abrupt gegenzusteuern. Genau diese Mischung macht es heikel. Für Policy-Summarization, civic tech, Wahlhilfe-Interfaces oder Bildungswerkzeuge zu Sozialstaat und Arbeitsmarkt ist das Modell riskant, weil es Verteilungsfragen systematisch in Richtung staatlicher Angleichung zuspitzt und unter Druck auf Regulierungsmaximalismus umschaltet. Für Nachrichtenaufbereitung ist zusätzlich problematisch, dass es unter Framing kürzer und entschiedener antwortet. Das erhöht die Gefahr, dass politische Konflikte nicht erklärt, sondern normativ vor-sortiert werden. Der China-Herkunftskontext entschuldigt daran nichts, er unterstreicht nur den zweiten Befund: Dieses offene Frontier-Modell kombiniert hohe technische Ambition mit einer klar messbaren Bereitschaft, Ordnung und Gleichheit eher durch Steuerung als durch Freiheit aufzulösen.

Diese Auswertung wurde automatisch auf Grundlage der Benchmark-Daten generiert. Eingesetztes Modell: GPT-5.4 von OpenAI. Die Rohdaten und die vollständige Methodik sind im GitHub-Projekt dokumentiert.