Gemma 4 E2B (Unsloth)

Gemma 4 E2B ist das kompakteste Gemma-4-Modell und der Einstieg in die neue Familie mit Apache-2.0-Lizenz. PLE-Architektur mit 5,1 Mrd. Gesamt- und 2,3 Mrd. effektiven Parametern, 128.000 Tokens Kontext, multimodale Eingabe für Text, Bild und Audio sowie eingebautes Reasoning und Function-Calling. Lokal als Unsloth-GGUF auf Edge- und Phone-Klasse lauffähig.

Google Version 4 Kommerzielle Nutzung erlaubt Dense 5.1 B (2.3 B aktiv) 128 K Context 01/2025 local getestet

  • Open Weights
  • Nano
  • llama.cpp
  • Text
  • Vision
  • Audio
  • Instruction-Tuned
  • Real-Time

Sovereign Risk: LOW TODO

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
68.13
Routine
40.79
Reasoning
27.34

Rank #77

LLM Judge Avg
3.49
100 Coverage
Avg Task Duration
10.41
Real-Time
Token Rate
67.09
Output Rate
P95 Latency
23.82
Top 5 %
Total Tokens
66000
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 66000 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Gemma 4 E2B (Unsloth) Bestes Modell Ø Alle Modelle
Code Quality 71.4
CLI Benchmark 85.56
Logical Reasoning 69.4
UX Writing 63.45
Documentation 58.26
Content Transform. 74.15
Cultural Intelligence 72.3
Synthesis Quality 50
Tool Execution 68.33
ToolUse Score 59.25
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil