Gemini 3.7 Flash

Gemini 3.7 Flash ist ein schnelles, kosteneffizientes und hochskalierbares multimodales Modell von Google. Es wurde für Aufgaben mit hoher Frequenz und geringer Latenz entwickelt und verfügt über ein Kontextfenster von einer Million Token. Das Modell verarbeitet Text, Bilder, Audio sowie Video und unterstützt die Nutzung externer Tools, was es vielseitig für Agenten-Anwendungen macht.

Google Version 3.7-flash Kommerzielle Nutzung erlaubt MoE 1000 K Context 01/2025 $0.75 / $3.75 per 1M

  • Proprietär
  • Frontier
  • OpenRouter
  • Text
  • Vision
  • Audio
  • Video
  • Agentic Orchestrator
  • Real-Time

Sovereign Risk: MEDIUM Google DeepMind ist ein US-amerikanisches Unternehmen und unterliegt dem CLOUD Act; die Modellgewichte sind nicht öffentlich zugänglich.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
74.4
Routine
45.22
Reasoning
29.19

Rank #42

LLM Judge Avg
3.7
100 Coverage
Avg Task Duration
10.51
Real-Time
Token Rate
115.05
Output Rate
P95 Latency
21.39
Top 5 %
Total Tokens
89400
Output Volume
Cost per 1K
$0.0038
USD / 1K Requests
Benchmark Cost
$0.34
Total · 89400 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Gemini 3.7 Flash Bestes Modell Ø Alle Modelle
Code Quality 72.2
CLI Benchmark 93
Logical Reasoning 67.15
UX Writing 72.49
Documentation 73.47
Content Transform. 76.26
Cultural Intelligence 69.96
Synthesis Quality 70
Tool Execution 90
ToolUse Score 80
Benchmark Cost $0.34

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil