GPT-OSS 120B (Thinking)

GPT-OSS 120B ist seit August 2025 OpenAIs grösstes Open-Weights-Modell, veröffentlicht unter Apache-2.0-Lizenz mit freier kommerzieller Nutzung. Das MoE bündelt 116,8 Milliarden Gesamt- bei nur 5,1 Milliarden aktiven Parametern pro Token und läuft dank nativer MXFP4-Quantisierung auf einer einzelnen High-Memory-GPU. Drei Reasoning-Stufen und natives Tool-Use im Harmony-Format runden das Profil ab.

OpenAI Version 1.0 Kommerzielle Nutzung erlaubt MoE 116.8 B (5.1 B aktiv) 131 K Context local getestet

  • Open Weights
  • Server
  • VSPK
  • Text
  • Configurable-Reasoning
  • MXFP4
  • Native-Quant
  • Harmony
  • Interactive

Sovereign Risk: LOW OpenAI ist ein US-Unternehmen; das Modell wird unter Apache-2.0 als Open Weights veröffentlicht. Lokales Deployment vermeidet vollständig jeglichen API-Datenabfluss an OpenAI-Server, wodurch das Risiko trotz US-Jurisdiktion (CLOUD Act) als gering eingestuft wird.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
73.41
Routine
44.77
Reasoning
28.64

Rank #38

LLM Judge Avg
3.65
100 Coverage
Avg Task Duration
36.63
Interactive
Token Rate
26.87
Output Rate
P95 Latency
87.49
Top 5 %
Total Tokens
85300
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 85300 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GPT-OSS 120B (Thinking) Bestes Modell Ø Alle Modelle
Code Quality 78.6
CLI Benchmark 88.33
Logical Reasoning 68.09
UX Writing 62.25
Documentation 69.68
Content Transform. 76.13
Cultural Intelligence 80
Synthesis Quality 55
Tool Execution 90
ToolUse Score 71.67
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil