GLM-4.7

GLM-4.7 ist das Flagship-Modell von Zhipu AI mit 355 Milliarden Gesamt- und 32 Milliarden aktiven Parametern in MoE-Architektur, optimiert für agentisches Coding, Reasoning und bilinguale Aufgaben in Chinesisch und Englisch. Das Modell unterstützt schaltbares Thinking-System und ist als Open-Weights-Variante lokal oder über Cloud-Schnittstellen einsetzbar.

Zhipu AI Version 4.7 Kommerzielle Nutzung erlaubt MoE 355 B (32 B aktiv) 128 K Context 12/2025 $0.38 / $1.74 per 1M

  • Restricted Weights
  • Frontier
  • OR
  • Text
  • Instruction-Tuned
  • Batch

Sovereign Risk: HIGH Zhipu AI / Z.AI ist ein chinesisches Unternehmen und unterliegt dem chinesischen National Security Law (NSL), das staatlichen Zugriff auf Daten ermöglichen kann. Das BSI hat im Februar 2025 explizit vor der Nutzung chinesischer KI-Cloud-Dienste gewarnt (BSI-Referenz: Warnung DeepSeek, 04.02.2025); diese Risikoeinschätzung gilt analog für alle chinesischen Cloud-KI-Anbieter, die Nutzerdaten auf chinesischen Servern verarbeiten. Bei rein lokaler Inferenz entfällt das Cloud-Act-äquivalente Risiko.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
74.47
Routine
45.16
Reasoning
29.32

Rank #25

LLM Judge Avg
3.9
100 Coverage
Avg Task Duration
48.84
Batch
Token Rate
26.12
Output Rate
P95 Latency
122.18
Top 5 %
Total Tokens
145700
Output Volume
Cost per 1K
$0.0017
USD / 1K Requests
Benchmark Cost
$0.25
Total · 145700 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GLM-4.7 Bestes Modell Ø Alle Modelle
Code Quality 70.56
CLI Benchmark 91.34
Logical Reasoning 76.87
UX Writing 75.73
Documentation 67.87
Content Transform. 77.14
Cultural Intelligence 81.72
Synthesis Quality 42.5
Tool Execution 83.33
ToolUse Score 62.75
Benchmark Cost $0.25

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil