GLM-4.7

GLM-4.7 ist das Flagship-Modell von Zhipu AI mit 355 Milliarden Gesamt- und 32 Milliarden aktiven Parametern in MoE-Architektur, optimiert für agentisches Coding, Reasoning und bilinguale Aufgaben in Chinesisch und Englisch. Das Modell unterstützt schaltbares Thinking-System und ist als Open-Weights-Variante lokal oder über Cloud-Schnittstellen einsetzbar.

Zhipu AI Version 4.7 Kommerzielle Nutzung erlaubt MoE 355 B (32 B aktiv) 128 K Context 12/2025 $0.4 / $1.75 per 1M

  • Restricted Weights
  • Frontier
  • OpenRouter
  • Text
  • Instruction-Tuned
  • Batch

Sovereign Risk: HIGH Zhipu AI / Z.AI ist ein chinesisches Unternehmen und unterliegt dem chinesischen National Security Law (NSL), das staatlichen Zugriff auf Daten ermöglichen kann. Das BSI hat im Februar 2025 explizit vor der Nutzung chinesischer KI-Cloud-Dienste gewarnt (BSI-Referenz: Warnung DeepSeek, 04.02.2025); diese Risikoeinschätzung gilt analog für alle chinesischen Cloud-KI-Anbieter, die Nutzerdaten auf chinesischen Servern verarbeiten. Bei rein lokaler Inferenz entfällt das Cloud-Act-äquivalente Risiko.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
72.9
Routine
44.33
Reasoning
28.56

Rank #49

LLM Judge Avg
3.71
100 Coverage
Avg Task Duration
67.1
Batch
Token Rate
58.77
Output Rate
P95 Latency
144.51
Top 5 %
Total Tokens
166400
Output Volume
Cost per 1K
$0.0018
USD / 1K Requests
Benchmark Cost
$0.29
Total · 166400 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GLM-4.7 Bestes Modell Ø Alle Modelle
Code Quality 67.2
CLI Benchmark 79.33
Logical Reasoning 72.67
UX Writing 74.99
Documentation 68.35
Content Transform. 76.97
Cultural Intelligence 75.96
Synthesis Quality 42.5
Tool Execution 83.33
ToolUse Score 70.92
Benchmark Cost $0.29

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil