Gemini 3.7 Flash

Gemini 3.7 Flash ist ein schnelles, kosteneffizientes und hochskalierbares multimodales Modell von Google. Es wurde für Aufgaben mit hoher Frequenz und geringer Latenz entwickelt und verfügt über ein Kontextfenster von einer Million Token. Das Modell verarbeitet Text, Bilder, Audio sowie Video und unterstützt die Nutzung externer Tools, was es vielseitig für Agenten-Anwendungen macht.

Google Version 3.7-flash Kommerzielle Nutzung erlaubt MoE 1000 K Context 01/2025

  • Proprietär
  • Frontier
  • OpenRouter
  • Text
  • Vision
  • Audio
  • Video
  • Agentic Orchestrator
  • Real-Time

Sovereign Risk: MEDIUM Google DeepMind ist ein US-amerikanisches Unternehmen und unterliegt dem CLOUD Act; die Modellgewichte sind nicht öffentlich zugänglich.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
71.61
Routine
43.86
Reasoning
27.75

Rank #56

LLM Judge Avg
3.57
100 Coverage
Avg Task Duration
8.69
Real-Time
Token Rate
95.98
Output Rate
P95 Latency
17.93
Top 5 %
Total Tokens
89500
Output Volume
Cost per 1K
Lokal getestet
USD / 1K Requests
Benchmark Cost
Lokal getestet
Total · 89500 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Gemini 3.7 Flash Bestes Modell Ø Alle Modelle
Code Quality 56.56
CLI Benchmark 90.67
Logical Reasoning 68.94
UX Writing 69.69
Documentation 72.08
Content Transform. 68.43
Cultural Intelligence 76.36
Synthesis Quality 70
Tool Execution 90
ToolUse Score 79.67
Benchmark Cost Lokal getestet

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil