Hermes 4.3 36B

Hermes 4.3 36B (NVFP4) ist die komprimierte Variante von NousResearchs Open-Weights-Modell auf ByteDance Seed-OSS-36B-Basis, vollständig dezentral über das Psyche-Netzwerk nachtrainiert. Firworks hat das BF16-Checkpoint zu NVFP4 komprimiert und damit den Gewichts-Speicherbedarf deutlich reduziert. 36 Milliarden Dense-Parameter, 512.000 Tokens nativer Kontext, optionaler Thinking-Modus und Apache-2.0-Lizenz für freie kommerzielle Nutzung.

NousResearch Version 4.3 Kommerzielle Nutzung erlaubt Dense 36 B 512 K Context 01/2025 local getestet

  • Open Weights
  • Server
  • VSPK
  • Text
  • 36B
  • NVFP4
  • Compressed-Tensors
  • 512K-Context
  • Long Context
  • Agentic Orchestrator
  • Batch

Sovereign Risk: MEDIUM Firworks/Hermes-4.3-36B-nvfp4 ist eine NVFP4-Quantisierung (LLM-Compressor, long-seq Calibration auf Rombo-Org/Optimized_Reasoning) der NousResearch-Basisgewichte (Hermes-4.3-36B auf ByteDance Seed-OSS-36B-Base, dezentral via Psyche nachtrainiert). Apache-2.0-Lizenz, öffentlich auf HuggingFace. NousResearch unterliegt US-CLOUD-Act; bei vollständig lokalem vLLM-Betrieb kein Cloud-Datenabfluss, Risiko bleibt moderat.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
67.14
Routine
41.19
Reasoning
25.95

Rank #86

LLM Judge Avg
3.24
100 Coverage
Avg Task Duration
84.81
Batch
Token Rate
12.71
Output Rate
P95 Latency
191.16
Top 5 %
Total Tokens
56700
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 56700 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Hermes 4.3 36B Bestes Modell Ø Alle Modelle
Code Quality 66.8
CLI Benchmark 82.22
Logical Reasoning 62.23
UX Writing 60.85
Documentation 62.58
Content Transform. 69.42
Cultural Intelligence 74
Synthesis Quality 43.33
Tool Execution 90
ToolUse Score 66.54
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil