Gemini 3.5 Flash

Gemini 3.5 Flash ist Googles schnellste Frontier-Klasse und liefert nahezu Pro-Level-Leistung bei Flash-Preisen. Mit Dynamic Thinking in vier konfigurierbaren Stufen, einem Kontextfenster von einer Million Tokens und vollständiger Multimodalität für Text, Bilder, Audio, Video und PDF eignet sich das Modell für agentische Workflows, Coding und Workloads mit hohem Durchsatz.

Google Version 3.5-flash Kommerzielle Nutzung erlaubt MoE 1000 K Context 01/2025 $1.5 / $9 per 1M

  • Proprietär
  • Frontier
  • Google Gemini
  • Text
  • Vision
  • Audio
  • Video
  • Agentic Orchestrator
  • Real-Time

Sovereign Risk: MEDIUM Google DeepMind ist ein US-amerikanisches Unternehmen und unterliegt dem CLOUD Act; die Modellgewichte sind nicht öffentlich zugänglich.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
77.17
Routine
46.95
Reasoning
30.22

Rank #11

LLM Judge Avg
3.88
100 Coverage
Avg Task Duration
9.69
Real-Time
Token Rate
58.67
Output Rate
P95 Latency
21.37
Top 5 %
Total Tokens
54300
Output Volume
Cost per 1K
$0.009
USD / 1K Requests
Benchmark Cost
$0.49
Total · 54300 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Gemini 3.5 Flash Bestes Modell Ø Alle Modelle
Code Quality 74.8
CLI Benchmark 93
Logical Reasoning 73.86
UX Writing 76.87
Documentation 74.3
Content Transform. 73.33
Cultural Intelligence 82.76
Synthesis Quality 63.33
Tool Execution 83.33
ToolUse Score 76.33
Benchmark Cost $0.49

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil