Hermes 4.3 36B (Thinking)
Hermes 4.3 36B (NVFP4) ist die komprimierte Variante von NousResearchs Open-Weights-Modell auf ByteDance Seed-OSS-36B-Basis, vollständig dezentral über das Psyche-Netzwerk nachtrainiert. Firworks hat das BF16-Checkpoint zu NVFP4 komprimiert und damit den Gewichts-Speicherbedarf deutlich reduziert. 36 Milliarden Dense-Parameter, 512.000 Tokens nativer Kontext, optionaler Thinking-Modus und Apache-2.0-Lizenz für freie kommerzielle Nutzung.
- Open Weights
- Server
- VSPK
- Text
- 36B
- NVFP4
- Compressed-Tensors
- 512K-Context
- Long Context
- Agentic Orchestrator
- Batch
Sovereign Risk: MEDIUM Firworks/Hermes-4.3-36B-nvfp4 ist eine NVFP4-Quantisierung (LLM-Compressor, long-seq Calibration auf Rombo-Org/Optimized_Reasoning) der NousResearch-Basisgewichte (Hermes-4.3-36B auf ByteDance Seed-OSS-36B-Base, dezentral via Psyche nachtrainiert). Apache-2.0-Lizenz, öffentlich auf HuggingFace. NousResearch unterliegt US-CLOUD-Act; bei vollständig lokalem vLLM-Betrieb kein Cloud-Datenabfluss, Risiko bleibt moderat.
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 68.02
- Routine
- 41.43
- Reasoning
- 26.59
- LLM Judge Avg
- 3.35 / 5
- 100 Coverage
- Avg Task Duration
- 62.15s
- Batch
- Token Rate
- 13.26tok/s
- Output Rate
- P95 Latency
- 160.89s
- Top 5 %
- Total Tokens
- 57400
- Output Volume
- Cost per 1K
- $0
- USD / 1K Requests
- Benchmark Cost
- $0
- Total · 57400 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian