Katalog
OpenAIweitergereicht

gpt-oss-20b

gpt-oss-20b ist das kleinere der beiden offenen Modelle von OpenAI (Apache 2.0, August 2025): ein Mixture-of-Experts-Netz mit 21 Mrd. Parametern, von denen je Token 3,6 Mrd. aktiv sind. OpenAI positioniert es für Anwendungen mit geringer Latenz und spezialisierte Aufgaben — Funktionsaufrufe, strukturierte Ausgabe, agentische Schritte —, der Denkaufwand ist in drei Stufen einstellbar. Eine vernünftige Wahl für Routineaufgaben, bei denen der Preis je Aufruf zählt: Klassifizieren, Extrahieren, Routing von Anfragen. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: gpt-oss-20b

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="gpt-oss-20b",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
128K Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,05 $/ 1M
Eingabe aus Cache
0,12 $/ 1M
Ausgabe
0,20 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
OpenAI
Veröffentlicht
August 2025
Lizenz
Apache-2.0
Architektur
Mixture of Experts · 21 Mrd. Parameter, 3,6 Mrd. aktiv je Token
Eingabe
Text
Denkmodus
Aufwand wählbar
Wissensstand
Juni 2024
Vom Entwickler genannte Sprachen
keine Angabe auf der Modellkarte

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

gpt-oss-120b oder gpt-oss-20b?

Beide sind Modelle mit offenen Gewichten, von OpenAI im August 2025 unter Apache 2.0 veröffentlicht, beide nur für Text, beide mit drei Stufen für den Denkaufwand (low, medium, high). Es sind nicht die Modelle hinter ChatGPT.

gpt-oss-120b hat 117 Mrd. Parameter, davon 5,1 Mrd. aktiv je Token, und ist auf Schlussfolgern im Produktivbetrieb ausgelegt; gpt-oss-20b hat 21 Mrd., davon 3,6 Mrd. aktiv, und kommt mit 16 GB Speicher aus — damit die richtige Wahl für Routineaufrufe, bei denen Latenz und Preis entscheiden.

Unterstützte Sprachen führt OpenAI nicht auf, hat die Leistung auf Deutsch aber gemessen: Im mehrsprachigen Test MMMLU erreicht gpt-oss-120b bei hohem Denkaufwand 83,0 %, gpt-oss-20b 78,7 %. Den Wissensstand gibt OpenAI mit Juni 2024 an. Wer die Gewichte selbst betreibt, braucht laut Modellkarte das Antwortformat „harmony“ von OpenAI; über unsere Schnittstelle genügt der übliche, oben gezeigte Chat-Completions-Aufruf.

Lizenz: was sie für Ihr Unternehmen bedeutet

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Benchmark-Ergebnisse laut Entwickler

AIME 2025
91,7 %
GPQA Diamond
71,5 %
MMLU
85,3 %
SWE-bench Verified
60,7 %

Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: arxiv.org/abs/2508.10925

Technische Angaben

Kontextfenster
128K Token
Maximale Ausgabe
65 536 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
Other
Streaming
ja
Offene Gewichte
openai/gpt-oss-20b
Unterstützte Parameter
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird gpt-oss-20b berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert gpt-oss-20b Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von gpt-oss-20b?

128K Token, davon bis zu 65 536 Token Ausgabe.

Was kostet gpt-oss-20b?

0,05 $ je Million Token Eingabe und 0,20 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei gpt-oss-20b eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht gpt-oss-20b Deutsch?

Die Modellkarte nennt keine Sprachen, also auch Deutsch nicht ausdrücklich. Prüfen Sie das Modell an eigenen deutschen Unterlagen, bevor Sie sich darauf verlassen. Allerdings hat OpenAI die Leistung auf Deutsch gemessen: Im mehrsprachigen Test MMMLU erreicht das Modell bei hohem Denkaufwand 78,7 %.

Unter welcher Lizenz steht gpt-oss-20b?

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Lässt sich der Denkmodus von gpt-oss-20b abschalten?

Der Entwickler lässt den Denkaufwand wählen; ein vollständiges Abschalten beschreibt die Modellkarte nicht.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
gpt-oss-20bOpenAI21B / 3,6B128KApache-2.00,05 $
gpt-oss-120bOpenAI117B / 5,1B128KApache-2.00,11 $
Mistral Small 24B (2501)Mistral AI24B32KApache-2.00,05 $
Cydonia 24B v4.1TheDrummer24B128K0,42 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: