gpt-oss-20b
OpenAI · USA · veröffentlicht 5. August 2025
Der Einstieg in lokale KI. Das kleinere offene Modell von OpenAI läuft auf einer Consumer-Grafikkarte und eignet sich gut zum Ausprobieren und für einfachere Aufgaben.
Modell auf Hugging Face ansehenBewertung im Detail
Gesamtnote aus drei gewichteten Dimensionen. Wie wir bewerten
Fähigkeitsprofil
Wo gpt-oss-20b stark ist, über sechs Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 25 Modelle im Vergleich. Wie die Säulen entstehen
| Säule | Wert | Grundlage |
|---|---|---|
| Programmierung | 58 | redaktionelle Einschätzung |
| Mathematik & Logik | 60 | redaktionelle Einschätzung |
| Wissen | 74 | benchmarkbelegt |
| Deutsch & Sprache | 70 | redaktionelle Einschätzung |
| Agentik & Werkzeuge | 58 | redaktionelle Einschätzung |
| Langer Kontext | 60 | redaktionelle Einschätzung |
Stärkste Säule: Wissen. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit „Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.
Steckbrief
- Architektur
- Mixture-of-Experts
- Parameter
- 21 Mrd. gesamt, 3,6 Mrd. aktiv je Token
- Kontextfenster
- 128K TokenVoller 128K-Kontext sprengt auf 24-GB-Karten den Speicher, praktisch 8K bis 32K.
- Lizenz
- Apache 2.0
- Eingabe
- Text
- Lokaler Betrieb
- Eine Consumer-GPU (16–24 GB, RTX 4090)
- Bei EU-Hostern
- SeltenPrimär Self-Hosting und On-Device
- Cloud-API (Richtwert)
- 0,07 € Eingabe / 0,32 € Ausgabe je Mio. TokenDrittanbieter-Median, Richtwert, umgerechnet aus USD
Benchmarks
Zu diesem Modell liegt neben den Hersteller-Angaben eine unabhängige Einordnung vor (Artificial Analysis).
gpt-oss-20b ist der Einstieg in lokale KI. Das kleinere offene Modell von OpenAI läuft auf einer leistungsfähigen Consumer-Grafikkarte und erreicht dabei ein hohes Tempo. Artificial Analysis ordnet es unabhängig mit einem Index von 48 ein. Zum Ausprobieren, für erste Prototypen und für einfachere Aufgaben ist es eine gute Wahl.
Ein praktischer Hinweis: Von den 21 Milliarden Parametern sind nur 3,6 Milliarden je Token aktiv, und das Modell passt in 16 GB Speicher. Der volle Kontext von 128.000 Token sprengt auf Consumer-Karten allerdings den Speicher, realistisch sind 8.000 bis 32.000 Token. Die Apache-2.0-Lizenz erlaubt jede Nutzung. Die Leistung liegt deutlich unter den großen Modellen, das ist der Preis für die geringe Hardware-Anforderung.
Stärken
- +Läuft auf einer einzelnen Consumer-GPU
- +Apache-2.0-Lizenz, hohes Tempo, unabhängig eingeordnet
- +Gut für erste Tests und einfachere Aufgaben
Grenzen
- −Deutlich geringere Leistung als die großen Modelle
- −Voller Kontext auf Consumer-Hardware kaum nutzbar
- −Nur Text
Quelle: Offizielle HF-Modellkarte openai/gpt-oss-20b und Artificial Analysis, 2025/2026. Stand der Recherche: 23. Juli 2026. Die Prozent-Bewertung ist eine redaktionelle Einschätzung von gewusst:KI.
Lokale KI im eigenen Unternehmen aufbauen
Wir begleiten die Auswahl des passenden Modells, die Hardware-Planung und den Betrieb, lokal oder bei einem europäischen Hoster. Einen Einstieg bietet unser Workshop zu lokaler KI oder ein direktes Gespräch.