GPT-OSS 20B

Was die meisten OpenAI-Modelle nicht können: GPT-OSS 20B ist OpenAIs erste Open-Weights-Veröffentlichung seit GPT-2 (5. August 2025) unter Apache-2.0-Lizenz. Das MoE mit 21 Milliarden Gesamt- und 3,6 Milliarden aktiven Parametern läuft dank nativer MXFP4-Quantisierung mit nur rund 16 GB Speicher auf einer einzelnen Consumer-GPU, unterstützt Tool-Use über das Harmony-Format und bietet 131.072 Tokens Kontext sowie konfigurierbare Reasoning-Intensität (low/medium/high).

OpenAI Version 1.0 Kommerzielle Nutzung erlaubt MoE 21 B (3.6 B aktiv) 128 K Context 06/2024 local getestet

  • Open Weights
  • Desktop
  • vLLM
  • Text
  • Long Context
  • Interactive

Sovereign Risk: LOW OpenAI ist ein US-Unternehmen; das Modell wird unter Apache-2.0 als Open Weights veröffentlicht. Lokales Deployment vermeidet vollständig jeglichen API-Datenabfluss an OpenAI-Server, wodurch das Risiko trotz US-Jurisdiktion (CLOUD Act) als gering eingestuft wird.

Schlüsselmetriken

Score · Latenz · Kosten · Qualität

Total Score Bronze
64.31
Routine
39.51
Reasoning
24.8

Rank #84

LLM Judge Avg
3.6
100 Coverage
Avg Task Duration
26.97
Interactive
Token Rate
41.46
Output Rate
P95 Latency
74.51
Top 5 %
Total Tokens
85300
Output Volume
Cost per 1K
$0
USD / 1K Requests
Benchmark Cost
$0
Total · 85300 tok

Benchmark-Module

10 Module · gewichtet · vs. Modellmedian & Spitzenreiter

GPT-OSS 20B Bestes Modell Ø Alle Modelle
Code Quality 78.9
CLI Benchmark 87.22
Logical Reasoning 66.24
UX Writing 69.15
Documentation 61.16
Content Transform. 66.55
Cultural Intelligence 69
Synthesis Quality 20
Tool Execution 35
ToolUse Score 27.75
Benchmark Cost $0

Token-Effizienz & Latenz

Verbrauch pro Modul vs. Modellmedian

Token-Verbrauch pro Modul

Performance-Profil