Qwen3.8 27B
Qwen3.8 27B в официальной сборке NVFP4 от RadixArk, работает на картах, которые мы держим в Европейской экономической зоне. Сильна в программировании, вызовах инструментов и агентской работе. На этой модели измерено всё, что указано на странице инфраструктуры: около 176 токенов в секунду на поток, первый токен за 0,3–0,9 секунды, и маршрутизация, удерживающая диалог на машине, где его контекст уже в кэше — попадание 91–97 процентов при агентской нагрузке, причём кэшированный ввод стоит долю от цены свежего. Запросы и ответы не пишутся в журналы и не хранятся.
ID модели: qwen38
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="qwen38", messages=[{"role": "user", "content": "Hello"}],)
Прайс-лист шлюза, состояние на 2026-08-29. Без минимального объёма и без подписки.
Эта модель работает на картах, которые мы держим в Европейской экономической зоне. Запросы и ответы не пишутся в журналы и не хранятся, ничего из них не идёт на обучение. На этой модели измерено всё, что указано на странице инфраструктуры: около 176 токенов в секунду, первый токен меньше чем за секунду, попадание в кэш 91–97 процентов при агентской нагрузке.
13 моделей ещё — по тому же ключу и в том же счёте.
Смотреть каталогОбновлено: