Gemini 3.8 Flash

Gemini 3.8 Flash ist Googles intelligentestes Flash-Modell (GA seit 2. September 2026), gebaut auf 3.7 Flash für Long-Horizon-Software-Engineering, autonome Agenten und komplexe Unternehmens-Workflows. Drei Thinking-Levels (low, medium, high, Standard medium) steuern die Reasoning-Tiefe; eine Million Tokens Kontext und 65.536 Output-Tokens fassen ganze Repositorys in einer Anfrage. Intro-Preis 0,75 / 3,75 USD pro Million Tokens bis Jahresende, danach 1,50 / 7,50.

Google Version 3.8 Kommerzielle Nutzung erlaubt Dense 1000 K Context $0.75 / $3.75 per 1M

  • Proprietär
  • Frontier
  • OpenRouter
  • Text
  • Vision
  • Real-Time

Sovereign Risk: MEDIUM Das Modell wird von einem US-amerikanischen Unternehmen entwickelt und gehostet. Aufgrund der US-Jurisdiktion unterliegt es potenziell dem CLOUD Act, was ein mittleres Risiko für den Datenzugriff durch US-Behörden darstellt. Da die Gewichte proprietär und nicht verteilt sind, besteht kein zusätzliches Risiko durch Weitergabe der Gewichte selbst.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
75.72
Routine
45.62
Reasoning
30.11

Rank #28

LLM Judge Avg
3.72
100 Coverage
Avg Task Duration
13.4
Real-Time
Token Rate
114.18
Output Rate
P95 Latency
25.78
Top 5 %
Total Tokens
107100
Output Volume
Cost per 1K
$0.0038
USD / 1K Requests
Benchmark Cost
$0.4
Total · 107100 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Gemini 3.8 Flash Bestes Modell Ø Alle Modelle
Code Quality 71.64
CLI Benchmark 86
Logical Reasoning 71.83
UX Writing 76.37
Documentation 74.26
Content Transform. 75.15
Cultural Intelligence 73.16
Synthesis Quality 76.67
Tool Execution 90
ToolUse Score 82.5
Benchmark Cost $0.4

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil