GLM-5.1

GLM-5.1 ist Z.AIs Post-Training-Upgrade mit 754 Milliarden Gesamt- und 40 Milliarden aktiven Parametern in MoE-Architektur, optimiert für langfristige agentische Coding-Workflows mit bis zu acht Stunden autonomer Ausführung. Das Kontextfenster umfasst 200.000 Tokens, die Gewichte sind unter MIT-Lizenz als Open-Weights-Modell verfügbar.

Zhipu AI Version 5.1 Kommerzielle Nutzung erlaubt MoE 754 B (40 B aktiv) 200 K Context 12/2025 $1.05 / $3.5 per 1M

  • Open Weights
  • Frontier
  • OpenRouter
  • Text
  • Instruction-Tuned
  • Agentic Orchestrator
  • Batch

Sovereign Risk: HIGH Z.AI (formerly Zhipu AI) ist ein chinesisches Unternehmen und unterliegt dem chinesischen National Security Law (NSL), das staatlichen Zugriff auf Daten ermöglichen kann. Das BSI hat im Februar 2025 explizit vor der Nutzung chinesischer KI-Cloud-Dienste gewarnt (BSI-Referenz: Warnung DeepSeek, 04.02.2025); diese Risikoeinschätzung gilt analog für alle chinesischen Cloud-KI-Anbieter, die Nutzerdaten auf chinesischen Servern verarbeiten. Bei rein lokaler Inferenz entfällt das Cloud-Act-äquivalente Risiko.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
73.34
Routine
44.56
Reasoning
28.78

Rank #40

LLM Judge Avg
3.74
100 Coverage
Avg Task Duration
62.37
Batch
Token Rate
63.54
Output Rate
P95 Latency
190.54
Top 5 %
Total Tokens
149000
Output Volume
Cost per 1K
$0.0035
USD / 1K Requests
Benchmark Cost
$0.52
Total · 149000 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GLM-5.1 Bestes Modell Ø Alle Modelle
Code Quality 71.28
CLI Benchmark 93
Logical Reasoning 74.4
UX Writing 72.21
Documentation 69.88
Content Transform. 79.51
Cultural Intelligence 68.52
Synthesis Quality 59.17
Tool Execution 90
ToolUse Score 67.75
Benchmark Cost $0.52

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil