gpt-oss-20b
gpt-oss-20b je menší z dvoch otvorených modelov OpenAI (Apache 2.0, august 2025): sieť typu mixture-of-experts s 21 miliardami parametrov, z ktorých je na jeden token aktívnych 3,6 miliardy. Spoločnosť OpenAI ho určila na úlohy s nízkou latenciou a úzkou špecializáciou (volanie funkcií, štruktúrovaný výstup, kroky agenta); hĺbka uvažovania sa nastavuje v troch stupňoch. Rozumná voľba na rutinné úlohy, kde rozhoduje cena za jedno volanie: klasifikácia, extrakcia polí, smerovanie požiadaviek. Poskytujeme ho prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy; požiadavky idú len k poskytovateľom, ktorí neuchovávajú vstupy ani odpovede.
ID modelu: gpt-oss-20b
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="gpt-oss-20b", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gpt-oss-20b", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "gpt-oss-20b", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.
O modeli
- Vývojár
- OpenAI
- Vydaný
- august 2025
- Licencia
- Apache-2.0
- Architektúra
- mixture of experts · 21 mld. parametrov, 3,6 mld. aktívnych na token
- Vstup
- text
- Uvažovanie
- voliteľná hĺbka
- Aktuálnosť znalostí
- jún 2024
- Jazyky, ktoré uvádza vývojár
- na karte modelu nie sú uvedené
Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.
gpt-oss-120b, alebo gpt-oss-20b?
Oba sú modely OpenAI s otvorenými váhami z augusta 2025 pod licenciou Apache 2.0, oba iba pre text a oba s tromi stupňami uvažovania (nízky, stredný, vysoký). Nie sú to modely, na ktorých beží ChatGPT.
gpt-oss-120b má 117 miliárd parametrov, z toho 5,1 miliardy aktívnych na token, a je určený na uvažovanie v produkčnom nasadení; gpt-oss-20b má 21 miliárd pri 3,6 miliardy aktívnych a zmestí sa do 16 GB pamäte – vhodná voľba na rutinné volania, pri ktorých rozhodujú latencia a cena.
Podporované jazyky OpenAI neuvádza; vo viacjazyčnom teste MMMLU testovala výkon v 14 jazykoch, medzi nimi však nie je slovenčina ani čeština. Znalosti modelov končia podľa OpenAI v júni 2024. Ak váhy prevádzkujete sami, karta vyžaduje formát odpovedí „harmony“ od OpenAI; cez naše API stačí bežné volanie chat completions uvedené vyššie.
Licencia: čo znamená pre vašu firmu
Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
Zhrnutie licencie, nie právne poradenstvo.
Výsledky testov podľa vývojára
- AIME 2025
- 91,7 %
- GPQA Diamond
- 71,5 %
- MMLU
- 85,3 %
- SWE-bench Verified
- 60,7 %
Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: arxiv.org/abs/2508.10925
Technické údaje
- Kontextové okno
- 128K tokenov
- Maximálny výstup
- 65 536 tokenov
- Limit priepustnosti
- 200K tok/min
- Tokenizer
- Other
- Streamovanie
- áno
- Otvorené váhy
- openai/gpt-oss-20b
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Tento model poskytujeme prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy: jedna zmluva o spracúvaní osobných údajov so spoločnosťou z EÚ, jedna faktúra za všetky modely, žiadny americký zmluvný partner vo vašich dokladoch. Výpočet môže bežať mimo EHP – kde sa vyžaduje spracovanie výlučne v EHP, je na mieste model na našom hardvéri.
Otázky k tomuto modelu
›Kde beží gpt-oss-20b?
Mimo EHP, cez globálneho poskytovateľa na základe našej európskej zmluvy. Máte jednu zmluvu o spracúvaní osobných údajov so spoločnosťou z EÚ a jednu faktúru, no samotný výpočet nebeží v EHP – hovoríme to otvorene, nezamlčiavame to.
›Ukladá gpt-oss-20b požiadavky a odpovede?
Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.
›Aké veľké je kontextové okno modelu gpt-oss-20b?
128K tokenov, z toho najviac 65 536 tokenov na výstupe.
›Koľko stojí gpt-oss-20b?
0,05 $ za milión vstupných tokenov a 0,20 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.
›Má gpt-oss-20b limit priepustnosti?
Áno, 200K tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.
›Rozumie gpt-oss-20b po slovensky?
Karta modelu neuvádza žiadne jazyky, teda ani slovenčinu. Model si pred nasadením overte na vlastných slovenských podkladoch. Vo viacjazyčnom teste MMMLU testovala OpenAI výkon v 14 jazykoch, medzi nimi však nie je slovenčina ani čeština.
›Pod akou licenciou vyšiel model gpt-oss-20b?
Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
›Dá sa pri modeli gpt-oss-20b vypnúť uvažovanie?
Vývojár umožňuje zvoliť hĺbku uvažovania; úplné vypnutie karta modelu neopisuje.
Porovnanie s podobnými modelmi
| Model | Vývojár | Parametre | Kontext | Licencia | Vstup / 1 mil. |
|---|---|---|---|---|---|
| gpt-oss-20b | OpenAI | 21B / 3,6B | 128K | Apache-2.0 | 0,05 $ |
| gpt-oss-120b | OpenAI | 117B / 5,1B | 128K | Apache-2.0 | 0,11 $ |
| Mistral Small 24B (2501) | Mistral AI | 24B | 32K | Apache-2.0 | 0,05 $ |
| Cydonia 24B v4.1 | TheDrummer | 24B | 128K | — | 0,42 $ |
30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.
Pozrieť si katalógNaposledy aktualizované: