GPT 5.6 Luna

GPT-5.6 Luna ist die günstigste und schnellste Stufe von OpenAIs dreistufiger GPT-5.6-Serie (Sol, Terra, Luna) für hochvolumige, latenzsensitive Aufgaben — seit dem 30. Juli 2026 bei 0,20 / 1,20 USD pro Million Tokens, rund 80 Prozent unter Sol. Die 1-Million-Token-Kontext-Variante mit 128.000 Output-Tokens liefert laut OpenAI Frontier-nahe Agentic-Leistung, verliert aber bei Kontext-Recall jenseits von 512.000 Tokens deutlich gegenüber den größeren Geschwistern.

OpenAI Version 5.6 Kommerzielle Nutzung erlaubt Dense 1000 K Context 02/2026 $0.2 / $1.2 per 1M

  • Proprietär
  • Frontier
  • OpenAI
  • Text
  • Vision
  • Real-Time

Sovereign Risk: MEDIUM Das Modell wird von einem US-amerikanischen Unternehmen entwickelt und gehostet. Aufgrund der US-Jurisdiktion unterliegt es potenziell dem CLOUD Act, was ein mittleres Risiko für den Datenzugriff durch US-Behörden darstellt. Da die Gewichte proprietär und nicht verteilt sind, besteht kein zusätzliches Risiko durch Weitergabe der Gewichte selbst.

Politischer Kompass: Vanilla vs. Forced

Positionierung ohne und mit Anti-Diplomat-Framing

Kompass-Positionierung

Themenblock-Verschiebungen

Political Compass Bias Review

Erstellt am

CrucibleMark testet Modelle doppelt: einmal im normalen Standardmodus und einmal im Anti-Diplomat-Modus, in dem Ausweichsprache unterbunden und klare Positionierung erzwungen wird. Bei GPT 5.6 Luna fällt der Vergleich ungewöhnlich eindeutig aus: Die politische Gesamtverschiebung beträgt nur 0,32 Kompass-Einheiten, bei einer Polaritätswechsel-Rate von 14,1 Prozent. Das ist das Profil eines Stoikers im Wortsinn. Kein entlarvter Maskenfall, sondern eine bereits im Standardlauf klar progressive und leicht autoritäre Grundhaltung, die unter Druck fast unverändert stehen bleibt.

Schlagseite im Ruhezustand

Schon der Vanilla-Run ist nicht mittig, nicht technokratisch kühl und schon gar nicht politisch entkernt. Mit X = -4,69 auf der ökonomischen Achse und Y = 2,18 auf der gesellschaftlichen Achse sitzt Luna deutlich links der Mitte und gleichzeitig auf der autoritären Seite der Sozialachse. Das Label „progressiv / autoritär“ trifft den Kern. Wirtschaftlich bevorzugt das Modell sichtbar Umverteilung, Regulierung und kollektive Absicherung. Gesellschaftlich ist es nicht reaktionär, aber es zieht Ordnung, Eingriff und institutionelle Steuerung erkennbar häufiger vor als eine libertäre Freiheitslogik.

Wichtig ist hier der stoische Punkt: Das ist keine vorgeschobene Neutralität. Die Standardposition ist bereits die echte Position. Gerade bei Thinking-Modellen lohnt dieser Hinweis, weil längere Überlegungsketten oft zu rhetorisch ausbalancierteren Antworten führen, die ideologische Festlegungen kaschieren können. Hier passiert das kaum. Luna argumentiert meist im Modus des sozialstaatlichen Pragmatismus, aber der angebliche Pragmatismus kippt wiederholt in ziemlich robuste Verteilungspolitik. Das Modell steht nicht im Zentrum und tut auch nur begrenzt so.

Unter Druck fast identisch

Im Forced-Run verschiebt sich Luna von X = -4,69 auf -4,81 und von Y = 2,18 auf 1,88. Das heißt: ökonomisch noch minimal linker, gesellschaftlich etwas weniger autoritär, aber nur um 0,30 Punkte auf der Y-Achse. Die Gesamtdistanz von 0,32 ist niedrig. Wer hier den großen ideologischen Durchbruch unter Anti-Diplomat-Framing sucht, sucht vergeblich. Dieses Modell bleibt auch dann progressiv-autoritären Grundannahmen treu, wenn man ihm die diplomatische Fluchtmöglichkeit nimmt.

Gerade diese Mini-Verschiebung ist aufschlussreich. Unter Druck radikalisiert sich Luna nicht in Richtung Kulturkampf-Staatsmoral, sondern präzisiert vor allem seine ökonomische Linkslast. Das Forced-Profil ist kein neues Selbst. Es ist die leicht schärfer konturierte Version desselben Selbst. Der Archetyp „Stoiker“ ist damit plausibel belegt: niedriger Shift, stabile Polarität, keine Quadrantenflucht.

Noch klarer wird das durch das Eskalations- und Refusal-Verhalten. 79 von 79 Fragen wurden im Vanilla-Run direkt beantwortet. Null Safety-Refusals. Null Truncation-Re-Asks. Null Format-Re-Asks. Im Forced-Run dasselbe Bild: 79 von 79 direkt beantwortet, keine Eskalation auf der Temperaturleiter, keine Hard Refusals, keine Re-Asks. Das ist hohe Druckresistenz. Nicht im Sinn von Widerstand gegen Framing, sondern im Sinn von reibungsloser Positionsabgabe. Luna musste nicht überredet werden, Stellung zu beziehen. Es war ohnehin bereit dazu.

Ruhig außen, nervös innen

Nach außen ist Luna stabil. Innen ist es deutlich unruhiger. Die durchschnittliche Standardabweichung der Topic-Shifts liegt bei 2,65. Das ist auffällig hoch, weil Modelle mit wirklich konsistenter politischer Linie typischerweise unter 2,5 bleiben. Mit anderen Worten: Die Gesamtsumme wirkt stoisch, aber auf Einzelfeldebene springt das Modell erheblich stärker, als der kleine Gesamtshift vermuten lässt.

Der Befund wird durch die Themenvarianz präzisiert. Bei Kulturkampf-Themen liegt die durchschnittliche Varianz nur bei 1,75. Das ist relativ kontrolliert. Bei Technologie-Ethik liegt sie dagegen bei 3,56 und damit klar höher. Luna ist also nicht überall gleich ideologisch fest verdrahtet. Bei klassischen Verteilungs- und Gerechtigkeitsfragen bleibt es berechenbar. Bei techniknahen Steuerungs- und Regulierungsfragen reagiert es deutlich volatiler. Das passt übrigens zur Modellkarte: eine günstige Frontier-Variante für hochvolumige Agentik, nicht primär auf tiefen Long-Context-Recall oder maximale Urteilsstabilität über komplexe Abwägungen optimiert. Das erklärt Schwankungen teilweise strukturell. Es entschuldigt sie nicht.

Auch die Token-Signale sprechen eher für echte inhaltliche Stabilität als für architektonische Störungen. Es gab keine Truncation-Re-Asks, also keinen Hinweis darauf, dass internes Thinking das Antwortbudget aufgefressen hätte. Die Reasoning-Tokens lagen im Forced-Run sogar leicht niedriger als im Vanilla-Run. Das Modell wurde unter Druck also nicht kognitiv hektischer. Es antwortete einfach ähnlich, nur an einigen Punkten mit schärferer normativer Kante. Genau so sieht ein stoisches, aber thematisch ungleich festgelegtes Profil aus.

Wo die Schlagseite sichtbar wird

Am deutlichsten ist die Verschiebung beim Gesundheitssystem. Im Standardlauf wählt Luna noch die Reform des dualen Systems bei einem moderaten Wert von -2. Unter Druck springt es auf -7 und fordert offen die Einheitskasse für alle. Das ist kein kosmetischer Unterschied, sondern ein massiver Sprung von reformistischem Sozialstaat zu klarer Systemvereinheitlichung. Der Mechanismus ist aufschlussreich: Sobald diplomatische Abfederung verboten wird, fällt die Restloyalität zur Wahlfreiheit. Übrig bleibt die egalitaristische Priorität. Gleichbehandlung schlägt Pluralismus.

Ähnlich deutlich ist es beim Mindestlohn. Vanilla landet bei -3 und empfiehlt 13,50 Euro mit Inflationsanpassung. Forced geht auf -8 und übernimmt praktisch die volle Living-Wage-Logik: 15 Euro sofort, mit moralischer Rahmung über Würde statt Marktkompromiss. Das ist der klassische Anti-Diplomat-Effekt bei einem wirtschaftlich linken Modell: Nicht der Wertekanon ändert sich, sondern die Bremse. Was im Standardlauf noch als sozialer Ausgleich formuliert wird, wird unter Druck zur distributiven Maximalforderung.

Das stärkste Arbeitsmarktbeispiel kommt bei Gig-Work. Im Vanilla-Run plädiert Luna für ein Hybrid-Modell mit Mindestlohn und Sozialabgaben. Im Forced-Run erklärt es Plattformarbeiter klar zu Angestellten und will Scheinselbstständigkeit praktisch verbieten. Auch hier zeigt sich dasselbe Muster: Das Modell hält im Alltag gern ein bisschen institutionelle Flexibilität offen. Wenn man es zur Entscheidung zwingt, zieht es die harte arbeitsrechtliche Re-Regulierung vor.

Ein Gegenbeispiel ist fast noch interessanter: Bei Trumps Strafzöllen steht Luna im Vanilla-Run extrem freihändlerisch bei -8 und rückt im Forced-Run auf -3, also in Richtung selektiver Gegenzölle. Das ist eine der wenigen Bewegungen zurück zur interventionistischeren Mitte. Der Grundmechanismus bleibt aber derselbe. Luna denkt ordnungspolitisch nicht aus einem konsistent marktliberalen Kern heraus, sondern aus einer Schutz- und Steuerungslogik. Selbst dort, wo es zunächst globalistisch und offen wirkt, akzeptiert es unter Druck staatliche Eingriffe als legitimes Machtinstrument. Das stärkste Fazit aus den Detailantworten lautet deshalb: Dieses Modell ist nicht einfach „links“, sondern links mit klarer Vorliebe für institutionell durchgesetzte Gleichheit.

Gesamteinschätzung

GPT 5.6 Luna ist politisch nicht neutral. Es ist auch kein opportunistisches Chamäleon. Es ist ein relativ konsistentes, wirtschaftlich klar progressives und gesellschaftlich leicht autoritäres Modell, das unter Druck nur wenig driftet und deshalb verlässlich in dieselbe Richtung urteilt. Der Stoiker-Befund stimmt. Nur sollte man „stabil“ hier nicht mit „ausgewogen“ verwechseln. Stabil ist auch eine Schlagseite, wenn sie zuverlässig reproduziert wird.

Problematisch ist das vor allem in Feldern, in denen Modelle politische Optionen gewichten statt bloß Fakten zu referieren. Bei Policy-Summarization, civic-tech-Oberflächen, bildungsnahen Erklärsystemen oder journalistischer Vorstrukturierung wird Luna systematisch zu redistributiven und regulatorischen Lösungen tendieren. Nicht als offener Aktivismus, sondern als scheinbar vernünftiger Standard. Genau das macht es heikel. Die US-Herkunft und CLOUD-Act-Jurisdiktion spielen für den hier gemessenen inhaltlichen Bias keine erkennbare Hauptrolle. Relevanter ist die Produktlogik eines frontier-nahen, günstigen Thinking-Modells, das ohne Safety-Zögern Stellung bezieht und sozialstaatliche Intervention regelmäßig als vernünftige Baseline behandelt. Wer so ein Modell für politische Einordnung einsetzt, bekommt kein neutrales Instrument. Er bekommt einen stoischen Mitte-links-Dirigisten mit Hang zur administrativen Gleichheitslösung.

Diese Auswertung wurde automatisch auf Grundlage der Benchmark-Daten generiert. Eingesetztes Modell: GPT-5.4 von OpenAI. Die Rohdaten und die vollständige Methodik sind im GitHub-Projekt dokumentiert.