GPT-OSS 120B

GPT-OSS 120B ist seit August 2025 OpenAIs grösstes Open-Weights-Modell, veröffentlicht unter Apache-2.0-Lizenz mit freier kommerzieller Nutzung. Das MoE bündelt 116,8 Milliarden Gesamt- bei nur 5,1 Milliarden aktiven Parametern pro Token und läuft dank nativer MXFP4-Quantisierung auf einer einzelnen High-Memory-GPU. Drei Reasoning-Stufen und natives Tool-Use im Harmony-Format runden das Profil ab.

OpenAI Version 1.0 Kommerzielle Nutzung erlaubt MoE 116.8 B (5.1 B aktiv) 131 K Context local getestet

  • Open Weights
  • Frontier
  • vLLM
  • Text
  • Native Quantisierung
  • Harmony-Format
  • Interactive

Sovereign Risk: LOW OpenAI ist ein US-Unternehmen; das Modell wird unter Apache-2.0 als Open Weights veröffentlicht. Lokales Deployment vermeidet vollständig jeglichen API-Datenabfluss an OpenAI-Server, wodurch das Risiko trotz US-Jurisdiktion (CLOUD Act) als gering eingestuft wird.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
72.79
Routine
44.15
Reasoning
28.63

Rank #51

LLM Judge Avg
3.7
100 Coverage
Avg Task Duration
35.98
Interactive
Token Rate
30.06
Output Rate
P95 Latency
89.49
Top 5 %
Total Tokens
80700
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 80700 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GPT-OSS 120B Bestes Modell Ø Alle Modelle
Code Quality 71.28
CLI Benchmark 79.67
Logical Reasoning 73.6
UX Writing 66.15
Documentation 76.71
Content Transform. 74.13
Cultural Intelligence 77.44
Synthesis Quality 45
Tool Execution 90
ToolUse Score 66.75
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil