GPT-OSS 120B

GPT-OSS 120B ist seit August 2025 OpenAIs grösstes Open-Weights-Modell, veröffentlicht unter Apache-2.0-Lizenz mit freier kommerzieller Nutzung. Das MoE bündelt 116,8 Milliarden Gesamt- bei nur 5,1 Milliarden aktiven Parametern pro Token und läuft dank nativer MXFP4-Quantisierung auf einer einzelnen High-Memory-GPU. Drei Reasoning-Stufen und natives Tool-Use im Harmony-Format runden das Profil ab.

OpenAI Version 1.0 Kommerzielle Nutzung erlaubt MoE 116.8 B (5.1 B aktiv) 131 K Context local getestet

  • Open Weights
  • Server
  • VSPK
  • Text
  • Configurable-Reasoning
  • MXFP4
  • Native-Quant
  • Harmony
  • Interactive

Sovereign Risk: LOW OpenAI ist ein US-Unternehmen; das Modell wird unter Apache-2.0 als Open Weights veröffentlicht. Lokales Deployment vermeidet vollständig jeglichen API-Datenabfluss an OpenAI-Server, wodurch das Risiko trotz US-Jurisdiktion (CLOUD Act) als gering eingestuft wird.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Silver
73.83
Routine
45.59
Reasoning
28.23

Rank #35

LLM Judge Avg
3.65
100 Coverage
Avg Task Duration
36.7
Interactive
Token Rate
27.53
Output Rate
P95 Latency
100.97
Top 5 %
Total Tokens
86000
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 86000 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GPT-OSS 120B Bestes Modell Ø Alle Modelle
Code Quality 78.4
CLI Benchmark 80
Logical Reasoning 65.49
UX Writing 74.05
Documentation 72.22
Content Transform. 79.48
Cultural Intelligence 78
Synthesis Quality 45
Tool Execution 90
ToolUse Score 66.04
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil