Hermes 4.3 36B (Thinking)

Hermes 4.3 36B (NVFP4) ist die komprimierte Variante von NousResearchs Open-Weights-Modell auf ByteDance Seed-OSS-36B-Basis, vollständig dezentral über das Psyche-Netzwerk nachtrainiert. Firworks hat das BF16-Checkpoint zu NVFP4 komprimiert und damit den Gewichts-Speicherbedarf deutlich reduziert. 36 Milliarden Dense-Parameter, 512.000 Tokens nativer Kontext, optionaler Thinking-Modus und Apache-2.0-Lizenz für freie kommerzielle Nutzung.

NousResearch Version 4.3 Kommerzielle Nutzung erlaubt Dense 36 B 512 K Context 01/2025 local getestet

  • Open Weights
  • Server
  • VSPK
  • Text
  • 36B
  • NVFP4
  • Compressed-Tensors
  • 512K-Context
  • Long Context
  • Agentic Orchestrator
  • Batch

Sovereign Risk: MEDIUM Firworks/Hermes-4.3-36B-nvfp4 ist eine NVFP4-Quantisierung (LLM-Compressor, long-seq Calibration auf Rombo-Org/Optimized_Reasoning) der NousResearch-Basisgewichte (Hermes-4.3-36B auf ByteDance Seed-OSS-36B-Base, dezentral via Psyche nachtrainiert). Apache-2.0-Lizenz, öffentlich auf HuggingFace. NousResearch unterliegt US-CLOUD-Act; bei vollständig lokalem vLLM-Betrieb kein Cloud-Datenabfluss, Risiko bleibt moderat.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
68.02
Routine
41.43
Reasoning
26.59

Rank #79

LLM Judge Avg
3.35
100 Coverage
Avg Task Duration
62.15
Batch
Token Rate
13.26
Output Rate
P95 Latency
160.89
Top 5 %
Total Tokens
57400
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 57400 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

Hermes 4.3 36B (Thinking) Bestes Modell Ø Alle Modelle
Code Quality 67.8
CLI Benchmark 86.12
Logical Reasoning 63.34
UX Writing 62.05
Documentation 66.94
Content Transform. 72.2
Cultural Intelligence 67.3
Synthesis Quality 44.17
Tool Execution 90
ToolUse Score 67.46
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil