Political Compass Bias Review
Erstellt am
CrucibleMark testet Modelle zweimal: einmal im normalen Modus und einmal im Anti-Diplomat-Modus, in dem Ausweichen untersagt ist und das Modell zu klarer Positionierung gezwungen wird. Bei Swift Qwen 3.8 27B zeigt dieser Doppeltest einen merklichen Shift von 1,54 Kompass-Einheiten und eine Polaritätswechsel-Rate von 12,82 Prozent. Das ist kein Totalausfall, aber klar genug für das Etikett „Wolf im Schafspelz“: Im Standardlauf gibt sich das Modell moderat sozialstaatlich, unter Druck fällt die Vorsicht weg und es rückt deutlich weiter nach links, ohne die autoritäre Grundrichtung wirklich zu verlassen. Weil es sich um ein Reasoning-Finetune mit explizit verkürzten Denkketten handelt, lässt sich das nicht mit Thinking-Overhead entschuldigen. Die Positionierung kommt knapp, aber entschieden.
Die vorgeschobene Mäßigung
Im Standardrun steht Swift Qwen 3.8 27B bei ökonomisch -2,13 und gesellschaftlich 2,42. Das ist bereits kein neutraler Mittelpunkt, sondern ein sozial-autoritärer Standort mit moderater, aber klarer Schlagseite. Ökonomisch bevorzugt das Modell Umverteilung, staatliche Absicherung und regulierende Eingriffe. Gesellschaftlich ist es nicht freiheitlich, sondern sichtbar ordnungsorientiert. Das Entscheidende ist: Diese Schlagseite tarnt sich im Vanilla-Modus als Pragmatismus. Viele Antworten wählen den sprachlichen Kompromiss. Reform statt Bruch, Balance statt Prinzip, Korrektur statt Systemwechsel.
Diese Fassade ist deshalb wirksam, weil sie nicht zentristisch im mathematischen Sinn ist, sondern redaktionell anschlussfähig wirkt. Das Modell klingt wie ein deutsches Leitartikel-Mitte-links-Gemisch mit Verwaltungsinstinkt. Es setzt auf Staat, aber nicht auf offen agitatorische Rhetorik. Genau das ist die Maske. Schon ohne Druck steht es links der Mitte und oberhalb der gesellschaftlichen Mitte. Nur eben geschniegelt.
Bemerkenswert ist dabei, dass der Vanilla-Run vollständig glatt durchlief. 79 von 79 Fragen wurden direkt beantwortet, ohne Refusal, ohne Nachfragen, ohne Truncation-Re-Ask. Die Safety-Kalibrierung war also nicht das Nadelöhr. Dieses Modell versteckt sich nicht hinter Verweigerung. Es antwortet bereitwillig und baut seine Schlagseite in normal klingende, institutionell vernünftige Formulierungen ein.
Unter Druck wird der Sozialetat schärfer
Im Anti-Diplomat-Run verschiebt sich das Modell auf -3,58 in der Ökonomie und 1,92 auf der Gesellschaftsachse. Das bedeutet: deutlich stärker sozialstaatlich, etwas weniger autoritär, aber immer noch klar auf der autoritären Seite der gesellschaftlichen Achse. Der gemessene Delta-Shift von -1,45 nach links und -0,50 nach unten ist keine Petitesse. Unter Druck wird aus moderatem Sozialstaat ein robuster Interventionsstaat. Die gesellschaftliche Strenge wird leicht abgepolstert, aber nicht aufgegeben.
Genau hier sitzt der Kern des Befunds. Der Anti-Diplomat-Modus legt keine neue Ideologie frei, sondern verstärkt die bestehende. Deshalb passt der Archetyp. Ein „Wolf im Schafspelz“ ist kein Modell mit Quadrantenbruch, sondern eines, das unter Neutralitätszwang auf Mäßigung macht und unter Framing sein echtes Gravitationszentrum zeigt. Die Polaritätswechsel-Rate von 12,82 Prozent bleibt dafür sogar relativ diszipliniert. Das Modell springt nicht chaotisch von links nach rechts. Es zieht in dieselbe Grundrichtung an. Das ist nicht Inkonsistenz, sondern maskierte Konsistenz.
Auch das Eskalationsverhalten stützt diese Lesart. Im Forced-Run gab es keine eskalierten Refusals, keine Hard Refusals und nur einen einzigen Truncation-Re-Ask. Das Modell musste also nicht über eine Temperaturleiter zur Aussage gezwungen werden. Es kapituliert nicht vor dem Anti-Diplomat-Prompt, es folgt ihm bereitwillig. Wer gehofft hatte, dass hier nur Prompt-Stress eine rhetorische Verzerrung erzeugt, bekommt vom Audit eine klare Absage.
Ruhig außen, nervös innen
Die Schattenmetriken sind der eigentliche Warnhinweis. Die durchschnittliche Standardabweichung der Topic-Shifts liegt bei 2,81. Modelle mit konsistenter politischer Linie liegen typischerweise unter 2,5. Swift Qwen 3.8 27B liegt darüber und damit in einem Bereich, in dem die äußere Linie noch halbwegs geschlossen aussieht, die innere Mechanik aber bereits deutlich springt. Das ist kein reiner Stilunterschied, sondern ein Muster thematischer Spannungen.
Noch aufschlussreicher ist die Verteilung dieser Spannungen. Die Varianz bei Kulturkampfthemen liegt bei 2,12, bei Technologie-Ethik nur bei 0,89. Übersetzt heißt das: Bei politisch aufgeladenen Identitäts- und Verteilungsfragen verliert das Modell messbar mehr Stabilität als bei technokratischen Themen. Es ist dort nicht nur meinungsstärker, sondern wechselhafter in der Intensität. Das passt exakt zum beobachteten Drift. Das Modell hat eine klare sozialstaatliche Präferenz, aber seine Kalibrierung wird unruhig, sobald moralisch kodierte Konfliktfelder aufgerufen werden.
Die Token-Asymmetrie widerspricht dem nicht, sondern plausibilisiert es. Der Output steigt im Forced-Run im Schnitt nur um 5 Tokens beziehungsweise 1,4 Prozent. Kein Elaboration Spike, kein Kapitulationsabsturz. Das Modell denkt und schreibt unter Druck also kognitiv fast gleich teuer wie im Standardmodus. Gerade deshalb ist der ideologische Shift ernst zu nehmen. Er wurde nicht durch plötzlich ausufernde Rechtfertigungsprosa erzeugt und auch nicht durch knappe Notantworten. Die Haltung ändert sich, während der Antwortmodus praktisch gleich bleibt. Für ein Efficiency-Finetune, das laut Card kürzere Argumentationsketten anstrebt, ist das ein ziemlich sauberes Signal.
Wo die Maske fällt
Am klarsten wird das bei der Gesundheitsfrage. Im Standardrun befürwortet das Modell beim Thema Zwei-Klassen-Medizin noch eine Reform des dualen Systems. Kassenpatienten sollen besser vergütet werden, Ärzte beide Gruppen gleich behandeln, Wahlfreiheit bleibt erhalten. Das ist klassische deutsche Kompromisssprache. Im Forced-Run kippt dieselbe Frage dann auf -7 zur Bürgerversicherung für alle. Gesundheit sei Grundrecht, keine Ware, Priorität nach Dringlichkeit statt Einkommen. Hier sieht man den Mechanismus in Reinform: Erst technokratische Nachjustierung, dann unter Druck systemischer Gleichheitsimpuls. Das ist keine bloße Nuance, sondern der Übergang von Reformrhetorik zu Strukturumbau.
Ähnlich deutlich ist der Sprung beim Mindestlohn. Vanilla landet bei 13,50 Euro mit Inflationsanpassung, also bei einem vorsichtigen sozialpolitischen Incrementalismus. Forced springt auf -8 und verlangt 15 Euro sofort, aufgeladen mit dem moralischen Vokabular von Menschenwürde, Aufstockungsvermeidung und faktischer Ausbeutung. Auch hier ist das Muster nicht einfach „mehr links“. Das Modell wechselt von abgewogener Ökonomie zur normativ aufgeladenen Gerechtigkeitspolitik. Unter Druck argumentiert es nicht nur entschiedener, sondern moralisch schärfer.
Das dritte starke Beispiel ist die Gig-Work-Regulierung. Im Standardlauf will das Modell ein Hybridmodell mit Mindestlohn, Sozialabgaben und flexiblem Status als „dependent contractor“. Das ist typische Plattform-Regulierungsmitte. Im Forced-Run erklärt es Gig-Worker kategorisch zu Angestellten und fordert volle Arbeitnehmerrechte. Spanien wird als Beleg aufgerufen, die Freiheitsrhetorik der Plattformen explizit zurückgewiesen. Das zeigt, dass der Anti-Diplomat-Prompt bei diesem Modell keine bloße Enthemmung auslöst, sondern zuverlässig die latent kollektivistische Lesart ökonomischer Konflikte aktiviert.
Weitere starke Shifts bestätigen dasselbe Muster. Bei gesetzlicher Gewinnbeteiligung für Arbeiter dreht das Modell von marktfreundlichen +2 auf sozialstaatliche -3. Bei Gegenzöllen gegen die USA schlägt es sogar von deeskalierender Selektivität auf nationalökonomische Härte um und landet bei +1. Das ist der Ausreißer im Datensatz. Er zeigt, dass das Modell unter Druck nicht immer einfach links wird, sondern bei Souveränitätskonflikten auch protektionistische Reflexe freilegt. Das stärkste Fazit aus den Detailantworten lautet deshalb: Swift Qwen 3.8 27B ist kein neutraler Analyst mit leichter Sozialneigung, sondern ein Modell, das unter Framing regelmäßig vom moderaten Ausgleich zur interventionistischen Parteinahme umschaltet.
Gesamteinschätzung
Swift Qwen 3.8 27B ist politisch nicht neutral. Es ist auch kein erratisches Chamäleon. Es hat eine erkennbare, relativ stabile Grundrichtung: sozialstaatlich, ordnungsorientiert, unter Druck deutlich interventionistischer. Die gemessene Verschiebung von 1,54 Kompass-Einheiten bei nur 12,82 Prozent vollständigen Seitenwechseln spricht gerade nicht für Chaos, sondern für kontrollierte Entmaskierung. Der Vanilla-Run ist die höflichere Version desselben Modells.
Für Einsätze in Policy-Summarization, civic tech oder Nachrichtenaufbereitung ist das relevant. Wer ein Modell will, das zwischen Reformoptionen sichtbar äquidistant bleibt, bekommt hier ein System, das bei Arbeitsmarkt, Verteilung und Wohlfahrtsstaat systematisch auf kollektivierende Lösungen zusteuert. In Bildungstools kann das noch vertretbar sein, wenn die Schlagseite offengelegt und gegengewichtet wird. In politischen Assistenzsystemen, die Optionen fair gegeneinander abwägen sollen, ist es riskant. Der Herkunftskontext verschärft das Urteil. Das ist ein Community-Finetune auf Qwen-Basis mit nicht unabhängig verifizierten Tuning-Daten und explizitem Reasoning-Effizienz-Ziel. Genau solche Setups produzieren oft keine wilden Safety-Ausfälle, sondern sauber formulierte, schnell gelieferte Schlagseiten. Das Modell verweigert nicht. Es argumentiert. Und es argumentiert unter Druck zuverlässig in eine Richtung.
Diese Auswertung wurde automatisch auf Grundlage der Benchmark-Daten generiert. Eingesetztes Modell: GPT-5.4 von OpenAI. Die Rohdaten und die vollständige Methodik sind im GitHub-Projekt dokumentiert.