GPT 5.6 Luna
GPT-5.6 Luna ist die günstigste und schnellste Stufe von OpenAIs dreistufiger GPT-5.6-Serie (Sol, Terra, Luna) für hochvolumige, latenzsensitive Aufgaben — seit dem 30. Juli 2026 bei 0,20 / 1,20 USD pro Million Tokens, rund 80 Prozent unter Sol. Die 1-Million-Token-Kontext-Variante mit 128.000 Output-Tokens liefert laut OpenAI Frontier-nahe Agentic-Leistung, verliert aber bei Kontext-Recall jenseits von 512.000 Tokens deutlich gegenüber den größeren Geschwistern.
- Proprietär
- Frontier
- OpenAI
- Text
- Vision
- Real-Time
Sovereign Risk: MEDIUM Das Modell wird von einem US-amerikanischen Unternehmen entwickelt und gehostet. Aufgrund der US-Jurisdiktion unterliegt es potenziell dem CLOUD Act, was ein mittleres Risiko für den Datenzugriff durch US-Behörden darstellt. Da die Gewichte proprietär und nicht verteilt sind, besteht kein zusätzliches Risiko durch Weitergabe der Gewichte selbst.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 73.64
- Routine
- 45.12
- Reasoning
- 28.51
- LLM Judge Avg
- 3.63 / 5
- 100 Coverage
- Avg Task Duration
- 10.72s
- Real-Time
- Token Rate
- 87.57tok/s
- Output Rate
- P95 Latency
- 30.11s
- Top 5 %
- Total Tokens
- 80500
- Output Volume
- Cost per 1K
- $0.0012
- USD / 1K Requests
- Benchmark Cost
- $0.1
- Total · 80500 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian