Каталог
NVIDIAчерез партнёров

Nemotron 3.5 Lightning

Nemotron 3.5 Lightning — небольшая гибридная модель NVIDIA (лицензия OpenMDW 1.1, август 2026): 30 млрд параметров, 3 млрд активны на токен, сочетание слоёв пространства состояний и «смеси экспертов» ради высокой пропускной способности. NVIDIA описывает её как модель общего назначения для рассуждения и диалога — агентские системы, чат-боты, поиск с генерацией, следование инструкциям. Поддерживаемые языки: английский, испанский, французский, немецкий, итальянский, японский; рассуждение включается и выключается. Исполняется через глобальных поставщиков по нашему европейскому договору; запросы уходят только тем, кто не хранит ни ввод, ни ответы.

ID модели: nemotron-3.5-lightning

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="nemotron-3.5-lightning",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Контекст
256K токенов
Где работает
Глобальные поставщики · договор с ЕС
Вызов инструментов
Рассуждение
Структурированный вывод
Работа с изображениями
Ввод
0,12 $/ 1M
Ввод из кэша
0,15 $/ 1M
Вывод
0,31 $/ 1M

Прайс-лист, состояние на 12 сентября 2026 г.. Без минимального объёма и без подписки.

О модели

Разработчик
NVIDIA
Выпущена
август 2026 г.
Лицензия
OpenMDW-1.1
Архитектура
смесь экспертов · 30 млрд параметров, 3 млрд активны на токен
Принимает на вход
текст
Рассуждение
включается и выключается в запросе
Языки, названные разработчиком
английский, испанский, французский, немецкий, итальянский, японский

Источник: карточка модели у разработчика, состояние на 17 сентября 2026 года.

Лицензия: что она означает для вашей компании

OpenMDW-1.1. OpenMDW 1.1 — разрешительная лицензия для весов и данных: по данным карточки модель можно использовать, изменять и строить на ней коммерческие продукты без отдельного разрешения.

Краткий пересказ лицензии, а не юридическая консультация.

Технические характеристики

Окно контекста
256K токенов
Максимум на выходе
65 536 токенов
Предел пропускной способности
200K ток/мин
Токенизатор
Other
Потоковая выдача
да
Открытые веса
nvidia/nemotron-3.5-lightning
Поддерживаемые параметры
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Куплено для вас, счёт от нас

Эта модель исполняется через глобальных поставщиков по нашему европейскому договору: один договор об обработке с компанией из ЕС, один счёт на все модели, без американского контрагента в ваших документах. Вычисление может идти за пределами ЕЭЗ — там, где нужна обработка строго в ЕЭЗ, подходит наша модель на своём железе.

Вопросы об этой модели

Где считается Nemotron 3.5 Lightning?

За пределами ЕЭЗ, через глобального поставщика по нашему европейскому договору. У вас один договор об обработке с компанией из ЕС и один счёт, но само вычисление идёт не в ЕЭЗ — мы говорим это прямо, а не умалчиваем.

Сохраняет ли Nemotron 3.5 Lightning запросы и ответы?

Нет. Модель работает без хранения данных: содержимое запросов не пишется в долговременное хранилище и ничего из него не идёт на обучение.

Насколько велико окно контекста у Nemotron 3.5 Lightning?

256K токенов, из них до 65 536 токенов на выходе.

Сколько стоит Nemotron 3.5 Lightning?

0,12 $ за миллион токенов входа и 0,31 $ за миллион токенов выхода. Без минимального объёма и подписки; один прайс-лист для интерфейса и для счёта.

Есть ли у Nemotron 3.5 Lightning предел пропускной способности?

Да, 200K токенов в минуту. Более высокий предел — вопрос объёма, а не принципа.

Понимает ли Nemotron 3.5 Lightning русский язык?

Русского нет в списке разработчика (английский, испанский, французский, немецкий, итальянский, японский). Проверьте модель на своих русскоязычных материалах, прежде чем на неё полагаться.

Под какой лицензией выпущена модель Nemotron 3.5 Lightning?

OpenMDW-1.1. OpenMDW 1.1 — разрешительная лицензия для весов и данных: по данным карточки модель можно использовать, изменять и строить на ней коммерческие продукты без отдельного разрешения.

Можно ли отключить рассуждение у Nemotron 3.5 Lightning?

Да. По данным разработчика, рассуждение можно включить или выключить отдельно для каждого запроса.

Сравнение с похожими моделями

МодельРазработчикПараметрыКонтекстЛицензияВвод / 1 млн
Nemotron 3.5 LightningNVIDIA30B / 3B256KOpenMDW-1.10,12 $
Nemotron 3 Super 120B A12BNVIDIA120B / 12B256KNVIDIA Nemotron Open Model License0,13 $
GLM-4.7-FlashZ.ai30B / 3B195KMIT0,09 $
Gemma 4 31BGoogle DeepMind30,7B256KApache-2.00,14 $

30 моделей ещё — по тому же ключу и в том же счёте.

Смотреть каталог

Обновлено: