Gemma 4 26B-A4B Instruct (Thinking)

Google DeepMind unterscheidet Gemma 4 26B-A4B Instruct bewusst von früheren Gemma-Generationen: unter echter Apache-2.0-Lizenz, also ohne restriktive Gemma-Nutzungsbedingungen. Das Open-Weight-MoE aktiviert pro Token nur etwa 3,8 von 25,2 Milliarden Parametern und unterstützt Multi-Token-Prediction für schnelleres Decoding. Multimodalität für Text und Bild, 262.144 Tokens Kontext, natives Function-Calling und konfigurierbarer Thinking-Modus runden das Profil ab.

Google Version 4 Kommerzielle Nutzung erlaubt MoE 25.2 B (3.8 B aktiv) 262 K Context 02/2026 local getestet

  • Open Weights
  • Workstation
  • vLLM
  • Text
  • Vision
  • Instruction-Tuned
  • Batch

Sovereign Risk: MEDIUM Google DeepMind ist ein US-Unternehmen, daher besteht bei Cloud-/API-Nutzung (z.B. Google Cloud, OpenRouter) US-CLOUD-Act-Exposition. Gemma 4 wurde im Gegensatz zu älteren Gemma-Generationen unter echter Apache-2.0-Lizenz veröffentlicht (keine Gemma Terms of Use mehr), was Fine-Tuning und kommerzielle Nutzung ohne Auflagen erlaubt. Bei rein lokalem Betrieb über llama.cpp/GGUF entfällt die CLOUD-Act-Relevanz vollständig, da keine Datenübertragung an Google erfolgt. Weights sind offen auf Hugging Face verfügbar.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
74.94
Routine
45.63
Reasoning
29.3

Rank #26

LLM Judge Avg
3.84
100 Coverage
Avg Task Duration
49.83
Batch
Token Rate
27.32
Output Rate
P95 Latency
91.09
Top 5 %
Total Tokens
141600
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 141600 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Gemma 4 26B-A4B Instruct (Thinking) Bestes Modell Ø Alle Modelle
Code Quality 70.12
CLI Benchmark 89
Logical Reasoning 76.55
UX Writing 68.51
Documentation 75.22
Content Transform. 78.64
Cultural Intelligence 74.24
Synthesis Quality 60
Tool Execution 82.5
ToolUse Score 74.25
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil