Каждая модель здесь: один ключ, один счёт, один европейский контрагент.
Схема совместима с OpenAI и Anthropic. Цены за миллион токенов прямо из прайс-листа шлюза — без минимального объёма и подписки.
Работает на картах, которые мы держим в Европейской экономической зоне. Без журналов, с кэшем префиксов, и каждое число о скорости на странице инфраструктуры измерено здесь. Кому нужна обработка строго в ЕЭЗ — остаётся на этом уровне.
Исполняется через глобальных поставщиков по нашему европейскому договору: вы подписываете один договор об обработке с компанией из ЕС и получаете один счёт на все модели вместо американского контрагента у каждого поставщика. Вычисление может идти за пределами ЕЭЗ — каталог говорит об этом прямо, а не умалчивает.
Все модели: один ключ, один счёт
Qwen3.8 27B
Official NVFP4 build on our own fleet in the EEA — the model every measurement on this page was taken on.
GLM 5.3 Flash
GLM-5.3-Flash is a native multimodal model from Z.ai
gpt-oss-120b
gpt-oss-120b is an open-weight, 117B-parameter Mixture-of-Experts (MoE) language model from OpenAI designed for high-reasoning, agentic, and general-purpose pro
DeepSeek V4 Flash 0423
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-tok
Hy3
Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-worl
MiMo-V2.5
MiMo-V2.5 is a native omnimodal model by Xiaomi
Mistral Small 4
Mistral Small 4 is the next major release in the Mistral Small family, unifying the capabilities of several flagship Mistral models into a single system
MiniMax M3
MiniMax-M3 is a multimodal foundation model from MiniMax
DeepSeek V4 Pro 0423
DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context w
Qwen3 Coder Plus
Qwen3 Coder Plus is Alibaba's proprietary version of the Open Source Qwen3 Coder 480B A35B
Kimi K2.7 Code
MoonshotAI: Kimi K2.7 Code is a coding-focused model in Moonshot AI's Kimi K2 family, built to complete end-to-end programming tasks reliably over long contexts
GLM 5.2
GLM 5.2 is a large-scale reasoning model from Z.ai
GLM 5.3
GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks
Kimi K3
Kimi K3 is a 2.8T parameter open-weight multimodal reasoning model from Moonshot AI
Цены из прайс-листа шлюза, состояние на 2026-08-29. Счёт следует за шлюзом, и эта страница следует за счётом — не наоборот.api.heabsy.com/openrouter/v1/models
Не хватает нужной модели?
Каталог через партнёров пополняется по запросу, а открытые модели можно поднять на нашем железе в ЕЭЗ, когда нагрузка оправдывает отдельную флотилию.
Где эти модели работают?
Не в чужом облаке: все перечисленные модели запускаются нанашей собственной инфраструктуре, поэтому запросы не уходят внешнему поставщику и плата не зависит от их числа. Что из этого следует для обработки персональных данных — в разделе осоответствии требованиям, а стоимость работ — на страницецен.
Частые вопросы
Какую модель выбрать?+
Для работы с документами на русском и немецком это решает пилот на ваших же материалах, а не рейтинг: на договорах и инструкциях модели расходятся заметно сильнее, чем показывают тесты. Там, где обработка должна оставаться строго в ЕЭЗ, подходит только модель на собственном железе.
Чем своё железо отличается от моделей через партнёров?+
На собственном железе карты держим мы, внутри Европейской экономической зоны: запросы не пишутся в журналы, ничего не идёт на обучение, обработка остаётся в ЕЭЗ. Модели через партнёров мы покупаем у глобальных поставщиков по своему европейскому договору: у вас один договор об обработке и один счёт, но вычисление может идти за пределами ЕЭЗ. В каталоге у каждой модели указано, что именно к ней относится.
Цены меняются?+
Они следуют прайс-листу шлюза и подтягиваются оттуда, а не правятся вручную. Дата состояния указана под каталогом. В счёт попадает то, что посчитал шлюз — эта страница следует за счётом, а не наоборот.
Есть минимальный объём?+
Нет, ни минимального оборота, ни подписки. Оплата по токенам, раздельно: свежий ввод, ввод из кэша и вывод. При агентской работе доля кэша самая большая, и стоит она долю от свежего.
Нужной модели нет — что делать?+
Каталог через партнёров пополняется по запросу. Открытые модели можно дополнительно поднять на нашем железе, когда нагрузка оправдывает отдельную флотилию — это вопрос объёма, а не принципа.
Обновлено: