Gemini 3.8 Flash
Gemini 3.8 Flash ist Googles intelligentestes Flash-Modell (GA seit 2. September 2026), gebaut auf 3.7 Flash für Long-Horizon-Software-Engineering, autonome Agenten und komplexe Unternehmens-Workflows. Drei Thinking-Levels (low, medium, high, Standard medium) steuern die Reasoning-Tiefe; eine Million Tokens Kontext und 65.536 Output-Tokens fassen ganze Repositorys in einer Anfrage. Intro-Preis 0,75 / 3,75 USD pro Million Tokens bis Jahresende, danach 1,50 / 7,50.
- Proprietär
- Frontier
- OpenRouter
- Text
- Vision
- Real-Time
Sovereign Risk: MEDIUM Das Modell wird von einem US-amerikanischen Unternehmen entwickelt und gehostet. Aufgrund der US-Jurisdiktion unterliegt es potenziell dem CLOUD Act, was ein mittleres Risiko für den Datenzugriff durch US-Behörden darstellt. Da die Gewichte proprietär und nicht verteilt sind, besteht kein zusätzliches Risiko durch Weitergabe der Gewichte selbst.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 75.72
- Routine
- 45.62
- Reasoning
- 30.11
- LLM Judge Avg
- 3.72 / 5
- 100 Coverage
- Avg Task Duration
- 13.4s
- Real-Time
- Token Rate
- 114.18tok/s
- Output Rate
- P95 Latency
- 25.78s
- Top 5 %
- Total Tokens
- 107100
- Output Volume
- Cost per 1K
- $0.0038
- USD / 1K Requests
- Benchmark Cost
- $0.4
- Total · 107100 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian