GPT 5.6 Luna

GPT-5.6 Luna ist die günstigste und schnellste Stufe von OpenAIs dreistufiger GPT-5.6-Serie (Sol, Terra, Luna) für hochvolumige, latenzsensitive Aufgaben — seit dem 30. Juli 2026 bei 0,20 / 1,20 USD pro Million Tokens, rund 80 Prozent unter Sol. Die 1-Million-Token-Kontext-Variante mit 128.000 Output-Tokens liefert laut OpenAI Frontier-nahe Agentic-Leistung, verliert aber bei Kontext-Recall jenseits von 512.000 Tokens deutlich gegenüber den größeren Geschwistern.

OpenAI Version 5.6 Kommerzielle Nutzung erlaubt Dense 1000 K Context 02/2026 $0.2 / $1.2 per 1M

  • Proprietär
  • Frontier
  • OpenAI
  • Text
  • Vision
  • Real-Time

Sovereign Risk: MEDIUM Das Modell wird von einem US-amerikanischen Unternehmen entwickelt und gehostet. Aufgrund der US-Jurisdiktion unterliegt es potenziell dem CLOUD Act, was ein mittleres Risiko für den Datenzugriff durch US-Behörden darstellt. Da die Gewichte proprietär und nicht verteilt sind, besteht kein zusätzliches Risiko durch Weitergabe der Gewichte selbst.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
73.64
Routine
45.12
Reasoning
28.51

Rank #52

LLM Judge Avg
3.63
100 Coverage
Avg Task Duration
10.72
Real-Time
Token Rate
87.57
Output Rate
P95 Latency
30.11
Top 5 %
Total Tokens
80500
Output Volume
Cost per 1K
$0.0012
USD / 1K Requests
Benchmark Cost
$0.1
Total · 80500 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GPT 5.6 Luna Bestes Modell Ø Alle Modelle
Code Quality 80.52
CLI Benchmark 89
Logical Reasoning 59.79
UX Writing 67.19
Documentation 67.85
Content Transform. 77.17
Cultural Intelligence 75.32
Synthesis Quality 75
Tool Execution 87.5
ToolUse Score 79.96
Benchmark Cost $0.1

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil