Grok 4.7

Grok 4.7 ist xAIs Frontier-Flaggschiff vom 21. September 2026, mit größerer Basis als Grok 4.6 und Trainings-Fokus auf mehrstündigen Aufgaben. 500.000 Tokens Kontext, Text- und Bild-Input, vier Reasoning-Stufen von low bis xhigh bei unveränderten 2 / 6 USD pro Million Tokens. Laut xAI fast verdoppelte Leistung bei langen Terminal-Aufgaben und ein neuer Safeguard-Stack gegen Jailbreaks.

xAI Version 4.7 Kommerzielle Nutzung eingeschränkt Dense 500 K Context 05/2026 $2 / $6 per 1M

  • Proprietär
  • Frontier
  • xAI
  • Text
  • Vision
  • Interactive

Sovereign Risk: MEDIUM Das Modell wird von einem US-amerikanischen Unternehmen entwickelt und gehostet. Aufgrund der US-Jurisdiktion unterliegt es potenziell dem CLOUD Act, was ein mittleres Risiko für den Datenzugriff durch US-Behörden darstellt. Da die Gewichte proprietär und nicht verteilt sind, besteht kein zusätzliches Risiko durch Weitergabe der Gewichte selbst.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
71.06
Routine
43.11
Reasoning
27.95

Rank #71

LLM Judge Avg
3.5
100 Coverage
Avg Task Duration
38.77
Interactive
Token Rate
17.39
Output Rate
P95 Latency
149.17
Top 5 %
Total Tokens
116600
Output Volume
Cost per 1K
$0.006
USD / 1K Requests
Benchmark Cost
$0.7
Total · 116600 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Grok 4.7 Bestes Modell Ø Alle Modelle
Code Quality 69.55
CLI Benchmark 90.67
Logical Reasoning 58.96
UX Writing 73.19
Documentation 62.08
Content Transform. 74.17
Cultural Intelligence 77.84
Synthesis Quality 53.33
Tool Execution 90
ToolUse Score 71.5
Benchmark Cost $0.7

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil