Gemma 4 26B A4B
Gemma 4 26B A4B — быстрая модель «смесь экспертов» серии Gemma от Google DeepMind (Apache 2.0): 25,2 млрд параметров, 3,8 млрд активны на токен. Справляется с рассуждением, кодом и агентскими сценариями со встроенным вызовом функций, читает документы, сканы, диаграммы и снимки экрана как изображения. Google заявляет поддержку более 35 языков «из коробки», не перечисляя их; режим рассуждения включается по желанию. Исполняется через глобальных поставщиков по нашему европейскому договору; запросы уходят только тем, кто не хранит ни ввод, ни ответы.
ID модели: gemma-4-26b-a4b-it
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="gemma-4-26b-a4b-it", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gemma-4-26b-a4b-it", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "gemma-4-26b-a4b-it", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Прайс-лист, состояние на 12 сентября 2026 г.. Без минимального объёма и без подписки.
О модели
- Разработчик
- Google DeepMind
- Лицензия
- Apache-2.0
- Архитектура
- смесь экспертов · 25,2 млрд параметров, 3,8 млрд активны на токен
- Принимает на вход
- текст, изображения
- Рассуждение
- включается и выключается в запросе
- Актуальность знаний
- январь 2025 г.
- Языки, названные разработчиком
- 35+ языков
Источник: карточка модели у разработчика, состояние на 17 сентября 2026 года.
Gemma 4 31B или 26B A4B?
Обе модели выпущены Google DeepMind под лицензией Apache 2.0, читают изображения наряду с текстом, поддерживают более 35 языков «из коробки», а рассуждение у них выключено, пока вы его не включите.
Gemma 4 31B — плотная модель (30,7 млрд параметров), и по карточке её результаты выше: 85,2 % в MMLU Pro и 80,0 % в LiveCodeBench v6. Gemma 4 26B A4B — «смесь экспертов» с 3,8 млрд активных параметров из 25,2 млрд, рассчитанная на скорость; в тех же тестах у неё 82,6 % и 77,1 %. Gemma-4-26B-A4B Uncensored — сборка 26B от сообщества, в которой отключены отказы.
Лицензия: что она о значает для вашей компании
Apache-2.0. Разрешительная лицензия open source: модель можно использовать, изменять и применять в коммерческих продуктах; при распространении весов вместе с ними нужно передавать текст лицензии и уведомления об авторских правах.
Краткий пересказ лицензии, а не юридическая консультация.
Результаты тестов по данным разработчика
- MMLU Pro
- 82,6 %
- GPQA Diamond
- 82,3 %
- MMMLU
- 86,3 %
- LiveCodeBench v6
- 77,1 %
Цифры из карточки модели, опубликованной разработчиком, — не наши замеры. Источник: huggingface.co/google/gemma-4-26B-A4B-it
Технические характеристики
- Окно контекста
- 256K токенов
- Максимум на выходе
- 65 536 токенов
- Предел пропускной способности
- 200K ток/мин
- Токенизатор
- Other
- Потоковая выдача
- да
- Открытые веса
- google/gemma-4-26b-a4b-it
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Эта модель исполняется через глобальных поставщиков по нашему европейскому договору: один договор об обработке с компанией из ЕС, один счёт на все модели, без американского контрагента в ваших документах. Вычисление может идти за пределами ЕЭЗ — там, где нужна обработка строго в ЕЭЗ, подходит наша модель на своём железе.
Вопросы об этой модели
›Где считается Gemma 4 26B A4B?
За пределами ЕЭЗ, через глобального поставщика по нашему европейскому договору. У вас один договор об обработке с компанией из ЕС и один счёт, но само вычисление идёт не в ЕЭЗ — мы говорим это прямо, а не умалчиваем.
›Сохраняет ли Gemma 4 26B A4B запросы и ответы?
Нет. Модель работает без хранения данных: содержимое запросов не пишется в долговременное хранилище и ничего из него не идёт на обучение.
›Насколько велико окно контекста у Gemma 4 26B A4B?
256K токенов, из них до 65 536 токенов на выходе.
›Сколько стоит Gemma 4 26B A4B?
0,07 $ за миллион токенов входа и 0,34 $ за миллион токенов выхода. Без минимального объёма и подписки; один прайс-лист для интерфейса и для счёта.
›Есть ли у Gemma 4 26B A4B предел пропускной способности?
Да, 200K токенов в минуту. Более высокий предел — вопрос объёма, а не принципа.
›Понимает ли Gemma 4 26B A4B русский язык?
Разработчик называет число поддерживаемых языков — более 35, — но не перечисляет их, поэтому поддержка русского документально не заявлена. Проверьте модель на своих русскоязычных материалах.
›Под какой лицензией выпущена модель Gemma 4 26B A4B?
Apache-2.0. Разрешительная лицензия open source: модель можно использовать, изменять и применять в коммерческих продуктах; при распространении весов вместе с ними нужно передавать текст лицензии и уведомления об авторских правах.
›Можно ли отключить рассуждение у Gemma 4 26B A4B?
Да. По данным разработчика, рассуждение можно включить или выключить отдельно для каждого запроса.
Сравнение с похожими моделями
| Модель | Разработчик | Параметры | Контекст | Лицензия | Ввод / 1 млн |
|---|---|---|---|---|---|
| Gemma 4 26B A4B | Google DeepMind | 25,2B / 3,8B | 256K | Apache-2.0 | 0,07 $ |
| Gemma 4 31B | Google DeepMind | 30,7B | 256K | Apache-2.0 | 0,14 $ |
| Mistral Small 24B (2501) | Mistral AI | 24B | 32K | Apache-2.0 | 0,05 $ |
| Cydonia 24B v4.1 | TheDrummer | 24B | 128K | — | 0,42 $ |
30 моделей ещё — по тому же ключу и в том же счёте.
Смотреть каталогОбновлено: