Swift Qwen 3.8 27B
Swift Qwen 3.8 27B ist UkisAIs Reasoning-Effizienz-Finetune auf Qwen 3.8 27B: bis zu 58 Prozent weniger Thinking-Tokens bei unter einem Prozent Performance-Verlust und rund doppelt so hoher Durchsatz auf Reasoning-Aufgaben. NVFP4-Quantisierung mit 262.000 Tokens Kontext, MTP-Head für Speculative Decoding und dokumentiertem Tool-Use — Lizenz mit kommerzieller ARR-Schwelle.
- Open Weights
- Workstation
- vLLM
- Text
- Vision
- Gated-Weights
- Batch
Sovereign Risk: MEDIUM TODO
Schlüsselmetriken
Score · Latenz · Kosten · Qualität
- Total Score Silver
- 77.78
- Routine
- 47.67
- Reasoning
- 30.12
- LLM Judge Avg
- 4.02 / 5
- 100 Coverage
- Avg Task Duration
- 106.87s
- Batch
- Token Rate
- 15.52tok/s
- Output Rate
- P95 Latency
- 291.59s
- Top 5 %
- Total Tokens
- 111100
- Output Volume
- Cost per 1K
- $0
- USD / 1K Requests
- Benchmark Cost
- $0
- Total · 111100 tok
Benchmark-Module
10 Module · gewichtet · vs. Modellmedian & Spitzenreiter
Token-Effizienz & Latenz
Verbrauch pro Modul vs. Modellmedian