Hermes 4 405B

Hermes 4 405B ist ein leistungsstarkes Instruct- und Reasoning-Modell von Nous Research mit 405 Milliarden Parametern, konzipiert für komplexe Reasoning-Aufgaben und agentische Workflows. Das Modell unterstützt optionales Thinking, präzise Tool-Aufrufe und strukturierte Ausgaben. Trainiert auf hohe Steuerbarkeit und reduzierte Refusal-Raten. Unter Meta-Llama-Community-Lizenz als Open-Weights-Modell verfügbar.

NousResearch Version 4 Kommerzielle Nutzung erlaubt Dense 405 B (405 B aktiv) 128 K Context 01/2025 $1 / $3 per 1M

  • Restricted Weights
  • Frontier
  • OR
  • Text
  • Instruction-Tuned
  • Real-Time

Sovereign Risk: LOW Nous Research ist ein US-amerikanisches Unternehmen und unterliegt dem CLOUD Act, jedoch sind die Gewichte öffentlich verfügbar und lokal betreibbar, sodass kein API-Zugriff durch Dritte erforderlich ist.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
67.76
Routine
40.87
Reasoning
26.9

Rank #81

LLM Judge Avg
3.3
100 Coverage
Avg Task Duration
18.37
Real-Time
Token Rate
39.49
Output Rate
P95 Latency
37.76
Top 5 %
Total Tokens
48900
Output Volume
Cost per 1K
$0.003
USD / 1K Requests
Benchmark Cost
$0.15
Total · 48900 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Hermes 4 405B Bestes Modell Ø Alle Modelle
Code Quality 67.64
CLI Benchmark 75.67
Logical Reasoning 66.26
UX Writing 68.93
Documentation 63.73
Content Transform. 70.49
Cultural Intelligence 61.04
Synthesis Quality 60
Tool Execution 90
ToolUse Score 74.33
Benchmark Cost $0.15

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil