Heabsy · Каталог моделей

Каждая модель здесь: один ключ, один счёт, один европейский контрагент.

Схема совместима с OpenAI и Anthropic. Цены за миллион токенов прямо из прайс-листа шлюза — без минимального объёма и подписки.

Своё железо — обработка в ЕЭЗ

Работает на картах, которые мы держим в Европейской экономической зоне. Без журналов, с кэшем префиксов, и каждое число о скорости на странице инфраструктуры измерено здесь. Кому нужна обработка строго в ЕЭЗ — остаётся на этом уровне.

Через партнёров — куплено для вас, счёт от нас

Исполняется через глобальных поставщиков по нашему европейскому договору: вы подписываете один договор об обработке с компанией из ЕС и получаете один счёт на все модели вместо американского контрагента у каждого поставщика. Вычисление может идти за пределами ЕЭЗ — каталог говорит об этом прямо, а не умалчивает.

Все модели: один ключ, один счёт

Qwen
our hardware · EEA

Qwen3.8 27B

Official NVFP4 build on our own fleet in the EEA — the model every measurement on this page was taken on.

128K contextTool callingStructured output
Input
$0.40
Cached
$0.05
Output
$3.00
/ 1M tok
Z.ai
routed

GLM 5.3 Flash

GLM-5.3-Flash is a native multimodal model from Z.ai

1.3M contextReasoningTool callingVision
Input
$0.08
Output
$0.25
/ 1M tok
openai
routed

gpt-oss-120b

gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose pro

128K contextReasoningTool callingStructured output
Input
$0.11
Output
$0.51
/ 1M tok
DeepSeek
routed

DeepSeek V4 Flash 0423

DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-tok

1M contextReasoningTool callingStructured output
Input
$0.25
Output
$0.50
/ 1M tok
tencent
routed

Hy3

Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-worl

256K contextReasoningTool callingStructured output
Input
$0.40
Output
$1.58
/ 1M tok
xiaomi
routed

MiMo-V2.5

MiMo-V2.5 is a native omnimodal model by Xiaomi

1M contextReasoningTool callingVision
Input
$0.42
Output
$0.84
/ 1M tok
Mistral
routed

Mistral Small 4

Mistral Small 4 is the next major release in the Mistral Small family, unifying the capabilities of several flagship Mistral models into a single system

256K contextReasoningTool callingVision
Input
$0.45
Output
$1.80
/ 1M tok
minimax
routed

MiniMax M3

MiniMax-M3 is a multimodal foundation model from MiniMax

1M contextReasoningTool callingVision
Input
$0.90
Output
$3.60
/ 1M tok
DeepSeek
routed

DeepSeek V4 Pro 0423

DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context w

1M contextReasoningTool callingStructured output
Input
$1.83
Output
$3.66
/ 1M tok
Qwen
routed

Qwen3 Coder Plus

Qwen3 Coder Plus is Alibaba's proprietary version of the Open Source Qwen3 Coder 480B A35B

1M contextTool callingStructured output
Input
$1.95
Output
$9.75
/ 1M tok
Moonshot AI
routed

Kimi K2.7 Code

MoonshotAI: Kimi K2.7 Code is a coding-focused model in Moonshot AI's Kimi K2 family, built to complete end-to-end programming tasks reliably over long contexts

256K contextReasoningTool callingVision
Input
$1.98
Output
$10.20
/ 1M tok
Z.ai
routed

GLM 5.2

GLM 5.2 is a large-scale reasoning model from Z.ai

1M contextReasoningTool callingStructured output
Input
$3.57
Output
$11.22
/ 1M tok
Z.ai
routed

GLM 5.3

GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks

1.3M contextReasoningTool callingStructured output
Input
$4.20
Output
$13.20
/ 1M tok
Moonshot AI
routed

Kimi K3

Kimi K3 is a 2.8T parameter open-weight multimodal reasoning model from Moonshot AI

1M contextReasoningTool callingVision
Input
$9.00
Output
$45.00
/ 1M tok

Цены из прайс-листа шлюза, состояние на 2026-08-29. Счёт следует за шлюзом, и эта страница следует за счётом — не наоборот.api.heabsy.com/openrouter/v1/models

Не хватает нужной модели?

Каталог через партнёров пополняется по запросу, а открытые модели можно поднять на нашем железе в ЕЭЗ, когда нагрузка оправдывает отдельную флотилию.

Напишите нам

Где эти модели работают?

Не в чужом облаке: все перечисленные модели запускаются нанашей собственной инфраструктуре, поэтому запросы не уходят внешнему поставщику и плата не зависит от их числа. Что из этого следует для обработки персональных данных — в разделе осоответствии требованиям, а стоимость работ — на страницецен.

Частые вопросы

Какую модель выбрать?+

Для работы с документами на русском и немецком это решает пилот на ваших же материалах, а не рейтинг: на договорах и инструкциях модели расходятся заметно сильнее, чем показывают тесты. Там, где обработка должна оставаться строго в ЕЭЗ, подходит только модель на собственном железе.

Чем своё железо отличается от моделей через партнёров?+

На собственном железе карты держим мы, внутри Европейской экономической зоны: запросы не пишутся в журналы, ничего не идёт на обучение, обработка остаётся в ЕЭЗ. Модели через партнёров мы покупаем у глобальных поставщиков по своему европейскому договору: у вас один договор об обработке и один счёт, но вычисление может идти за пределами ЕЭЗ. В каталоге у каждой модели указано, что именно к ней относится.

Цены меняются?+

Они следуют прайс-листу шлюза и подтягиваются оттуда, а не правятся вручную. Дата состояния указана под каталогом. В счёт попадает то, что посчитал шлюз — эта страница следует за счётом, а не наоборот.

Есть минимальный объём?+

Нет, ни минимального оборота, ни подписки. Оплата по токенам, раздельно: свежий ввод, ввод из кэша и вывод. При агентской работе доля кэша самая большая, и стоит она долю от свежего.

Нужной модели нет — что делать?+

Каталог через партнёров пополняется по запросу. Открытые модели можно дополнительно поднять на нашем железе, когда нагрузка оправдывает отдельную флотилию — это вопрос объёма, а не принципа.

Обновлено: