Каталог
OpenAIчерез партнёров

gpt-oss-20b

gpt-oss-20b — младшая из двух открытых моделей OpenAI (Apache 2.0, август 2025): сеть «смесь экспертов» на 21 млрд параметров, из которых на токен активны 3,6 млрд. OpenAI предназначает её для задач с малой задержкой и узкой специализацией — вызов функций, структурированный вывод, шаги агента; глубина рассуждения задаётся тремя уровнями. Разумный выбор для рутинных операций, где важна цена одного вызова: классификация, извлечение полей, маршрутизация. Исполняется через глобальных поставщиков по нашему европейскому договору; запросы уходят только тем, кто не хранит ни ввод, ни ответы.

ID модели: gpt-oss-20b

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="gpt-oss-20b",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Контекст
128K токенов
Где работает
Глобальные поставщики · договор с ЕС
Вызов инструментов
Рассуждение
Структурированный вывод
Работа с изображениями
Ввод
0,05 $/ 1M
Ввод из кэша
0,12 $/ 1M
Вывод
0,20 $/ 1M

Прайс-лист, состояние на 12 сентября 2026 г.. Без минимального объёма и без подписки.

О модели

Разработчик
OpenAI
Выпущена
август 2025 г.
Лицензия
Apache-2.0
Архитектура
смесь экспертов · 21 млрд параметров, 3,6 млрд активны на токен
Принимает на вход
текст
Рассуждение
выбирается глубина
Актуальность знаний
июнь 2024 г.
Языки, названные разработчиком
в карточке модели не указаны

Источник: карточка модели у разработчика, состояние на 17 сентября 2026 года.

gpt-oss-120b или gpt-oss-20b?

Обе — модели OpenAI с открытыми весами, выпущенные в августе 2025 года под лицензией Apache 2.0; обе работают только с текстом, и у обеих три уровня глубины рассуждения (low, medium, high). Это не те модели, на которых работает ChatGPT.

У gpt-oss-120b 117 млрд параметров, из них 5,1 млрд активны на токен, — она рассчитана на рассуждение в производственных задачах; у gpt-oss-20b — 21 млрд при 3,6 млрд активных; она укладывается в 16 ГБ памяти, поэтому подходит для рутинных вызовов, где решают задержка и цена.

Поддерживаемых языков OpenAI не перечисляет; она проверила модели на 14 языках многоязычного теста MMMLU, русского среди них нет. Актуальность знаний, по данным OpenAI, — июнь 2024 года. Если разворачивать модель у себя, по карточке нужен формат ответов harmony от OpenAI; через наш API достаточно обычного вызова chat completions, показанного выше.

Лицензия: что она означает для вашей компании

Apache-2.0. Разрешительная лицензия open source: модель можно использовать, изменять и применять в коммерческих продуктах; при распространении весов вместе с ними нужно передавать текст лицензии и уведомления об авторских правах.

Краткий пересказ лицензии, а не юридическая консультация.

Результаты тестов по данным разработчика

AIME 2025
91,7 %
GPQA Diamond
71,5 %
MMLU
85,3 %
SWE-bench Verified
60,7 %

Цифры из карточки модели, опубликованной разработчиком, — не наши замеры. Источник: arxiv.org/abs/2508.10925

Технические характеристики

Окно контекста
128K токенов
Максимум на выходе
65 536 токенов
Предел пропускной способности
200K ток/мин
Токенизатор
Other
Потоковая выдача
да
Открытые веса
openai/gpt-oss-20b
Поддерживаемые параметры
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Куплено для вас, счёт от нас

Эта модель исполняется через глобальных поставщиков по нашему европейскому договору: один договор об обработке с компанией из ЕС, один счёт на все модели, без американского контрагента в ваших документах. Вычисление может идти за пределами ЕЭЗ — там, где нужна обработка строго в ЕЭЗ, подходит наша модель на своём железе.

Вопросы об этой модели

Где считается gpt-oss-20b?

За пределами ЕЭЗ, через глобального поставщика по нашему европейскому договору. У вас один договор об обработке с компанией из ЕС и один счёт, но само вычисление идёт не в ЕЭЗ — мы говорим это прямо, а не умалчиваем.

Сохраняет ли gpt-oss-20b запросы и ответы?

Нет. Модель работает без хранения данных: содержимое запросов не пишется в долговременное хранилище и ничего из него не идёт на обучение.

Насколько велико окно контекста у gpt-oss-20b?

128K токенов, из них до 65 536 токенов на выходе.

Сколько стоит gpt-oss-20b?

0,05 $ за миллион токенов входа и 0,20 $ за миллион токенов выхода. Без минимального объёма и подписки; один прайс-лист для интерфейса и для счёта.

Есть ли у gpt-oss-20b предел пропускной способности?

Да, 200K токенов в минуту. Более высокий предел — вопрос объёма, а не принципа.

Понимает ли gpt-oss-20b русский язык?

В карточке модели языки не названы — значит, и русский прямо не заявлен. Проверьте модель на своих русскоязычных материалах, прежде чем на неё полагаться. OpenAI проверила модель на 14 языках многоязычного теста MMMLU; русского среди них нет.

Под какой лицензией выпущена модель gpt-oss-20b?

Apache-2.0. Разрешительная лицензия open source: модель можно использовать, изменять и применять в коммерческих продуктах; при распространении весов вместе с ними нужно передавать текст лицензии и уведомления об авторских правах.

Можно ли отключить рассуждение у gpt-oss-20b?

Разработчик позволяет выбрать глубину рассуждения; полное отключение в карточке не описано.

Сравнение с похожими моделями

МодельРазработчикПараметрыКонтекстЛицензияВвод / 1 млн
gpt-oss-20bOpenAI21B / 3,6B128KApache-2.00,05 $
gpt-oss-120bOpenAI117B / 5,1B128KApache-2.00,11 $
Mistral Small 24B (2501)Mistral AI24B32KApache-2.00,05 $
Cydonia 24B v4.1TheDrummer24B128K0,42 $

30 моделей ещё — по тому же ключу и в том же счёте.

Смотреть каталог

Обновлено: