Gemini 3.7 Flash
Gemini 3.7 Flash ist ein schnelles, kosteneffizientes und hochskalierbares multimodales Modell von Google. Es wurde für Aufgaben mit hoher Frequenz und geringer Latenz entwickelt und verfügt über ein Kontextfenster von einer Million Token. Das Modell verarbeitet Text, Bilder, Audio sowie Video und unterstützt die Nutzung externer Tools, was es vielseitig für Agenten-Anwendungen macht.
- Proprietär
- Frontier
- OpenRouter
- Text
- Vision
- Audio
- Video
- Agentic Orchestrator
- Real-Time
Sovereign Risk: MEDIUM Google DeepMind ist ein US-amerikanisches Unternehmen und unterliegt dem CLOUD Act; die Modellgewichte sind nicht öffentlich zugänglich.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 71.61
- Routine
- 43.86
- Reasoning
- 27.75
- LLM Judge Avg
- 3.57 / 5
- 100 Coverage
- Avg Task Duration
- 8.69s
- Real-Time
- Token Rate
- 95.98tok/s
- Output Rate
- P95 Latency
- 17.93s
- Top 5 %
- Total Tokens
- 89500
- Output Volume
- Cost per 1K
- Lokal getestet
- USD / 1K Requests
- Benchmark Cost
- Lokal getestet
- Total · 89500 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian