Katalóg
OpenAIsprostredkované

gpt-oss-20b

gpt-oss-20b je menší z dvoch otvorených modelov OpenAI (Apache 2.0, august 2025): sieť typu mixture-of-experts s 21 miliardami parametrov, z ktorých je na jeden token aktívnych 3,6 miliardy. Spoločnosť OpenAI ho určila na úlohy s nízkou latenciou a úzkou špecializáciou (volanie funkcií, štruktúrovaný výstup, kroky agenta); hĺbka uvažovania sa nastavuje v troch stupňoch. Rozumná voľba na rutinné úlohy, kde rozhoduje cena za jedno volanie: klasifikácia, extrakcia polí, smerovanie požiadaviek. Poskytujeme ho prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy; požiadavky idú len k poskytovateľom, ktorí neuchovávajú vstupy ani odpovede.

ID modelu: gpt-oss-20b

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="gpt-oss-20b",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
128K tokenov
Prevádzka
Globálni poskytovatelia · zmluva v EÚ
Volanie nástrojov
Uvažovanie
Štruktúrovaný výstup
Obrazový vstup
Vstup
0,05 $/ 1M
Vstup z cache
0,12 $/ 1M
Výstup
0,20 $/ 1M

Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.

O modeli

Vývojár
OpenAI
Vydaný
august 2025
Licencia
Apache-2.0
Architektúra
mixture of experts · 21 mld. parametrov, 3,6 mld. aktívnych na token
Vstup
text
Uvažovanie
voliteľná hĺbka
Aktuálnosť znalostí
jún 2024
Jazyky, ktoré uvádza vývojár
na karte modelu nie sú uvedené

Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.

gpt-oss-120b, alebo gpt-oss-20b?

Oba sú modely OpenAI s otvorenými váhami z augusta 2025 pod licenciou Apache 2.0, oba iba pre text a oba s tromi stupňami uvažovania (nízky, stredný, vysoký). Nie sú to modely, na ktorých beží ChatGPT.

gpt-oss-120b má 117 miliárd parametrov, z toho 5,1 miliardy aktívnych na token, a je určený na uvažovanie v produkčnom nasadení; gpt-oss-20b má 21 miliárd pri 3,6 miliardy aktívnych a zmestí sa do 16 GB pamäte – vhodná voľba na rutinné volania, pri ktorých rozhodujú latencia a cena.

Podporované jazyky OpenAI neuvádza; vo viacjazyčnom teste MMMLU testovala výkon v 14 jazykoch, medzi nimi však nie je slovenčina ani čeština. Znalosti modelov končia podľa OpenAI v júni 2024. Ak váhy prevádzkujete sami, karta vyžaduje formát odpovedí „harmony“ od OpenAI; cez naše API stačí bežné volanie chat completions uvedené vyššie.

Licencia: čo znamená pre vašu firmu

Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Zhrnutie licencie, nie právne poradenstvo.

Výsledky testov podľa vývojára

AIME 2025
91,7 %
GPQA Diamond
71,5 %
MMLU
85,3 %
SWE-bench Verified
60,7 %

Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: arxiv.org/abs/2508.10925

Technické údaje

Kontextové okno
128K tokenov
Maximálny výstup
65 536 tokenov
Limit priepustnosti
200K tok/min
Tokenizer
Other
Streamovanie
áno
Otvorené váhy
openai/gpt-oss-20b
Podporované parametre
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Nakúpené pre vás, fakturované nami

Tento model poskytujeme prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy: jedna zmluva o spracúvaní osobných údajov so spoločnosťou z EÚ, jedna faktúra za všetky modely, žiadny americký zmluvný partner vo vašich dokladoch. Výpočet môže bežať mimo EHP – kde sa vyžaduje spracovanie výlučne v EHP, je na mieste model na našom hardvéri.

Otázky k tomuto modelu

Kde beží gpt-oss-20b?

Mimo EHP, cez globálneho poskytovateľa na základe našej európskej zmluvy. Máte jednu zmluvu o spracúvaní osobných údajov so spoločnosťou z EÚ a jednu faktúru, no samotný výpočet nebeží v EHP – hovoríme to otvorene, nezamlčiavame to.

Ukladá gpt-oss-20b požiadavky a odpovede?

Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.

Aké veľké je kontextové okno modelu gpt-oss-20b?

128K tokenov, z toho najviac 65 536 tokenov na výstupe.

Koľko stojí gpt-oss-20b?

0,05 $ za milión vstupných tokenov a 0,20 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.

Má gpt-oss-20b limit priepustnosti?

Áno, 200K tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.

Rozumie gpt-oss-20b po slovensky?

Karta modelu neuvádza žiadne jazyky, teda ani slovenčinu. Model si pred nasadením overte na vlastných slovenských podkladoch. Vo viacjazyčnom teste MMMLU testovala OpenAI výkon v 14 jazykoch, medzi nimi však nie je slovenčina ani čeština.

Pod akou licenciou vyšiel model gpt-oss-20b?

Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Dá sa pri modeli gpt-oss-20b vypnúť uvažovanie?

Vývojár umožňuje zvoliť hĺbku uvažovania; úplné vypnutie karta modelu neopisuje.

Porovnanie s podobnými modelmi

ModelVývojárParametreKontextLicenciaVstup / 1 mil.
gpt-oss-20bOpenAI21B / 3,6B128KApache-2.00,05 $
gpt-oss-120bOpenAI117B / 5,1B128KApache-2.00,11 $
Mistral Small 24B (2501)Mistral AI24B32KApache-2.00,05 $
Cydonia 24B v4.1TheDrummer24B128K0,42 $

30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.

Pozrieť si katalóg

Naposledy aktualizované: