Каталог
Qwenчерез партнёров

Qwen3.8 Flash-Next

Qwen3.8 Flash-Next — открытая основа размещённой у разработчика Qwen3.8-Flash (лицензия Qwen Community License 1.0, август 2026) и, по словам авторов, экспериментальный предпросмотр архитектуры будущей Qwen4: «смесь экспертов» на 125 млрд параметров, 6 млрд активны на токен, с блочно-разреженным вниманием. Настроена на агентскую работу с малой задержкой на длинном контексте; принимает текст, изображения и видео — помощь в программировании, разбор документов и кодовых баз, управление интерфейсом. Исполняется через глобальных поставщиков по нашему европейскому договору; запросы уходят только тем, кто не хранит ни ввод, ни ответы.

ID модели: qwen3.8-flash-next

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="qwen3.8-flash-next",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Контекст
256K токенов
Где работает
Глобальные поставщики · договор с ЕС
Вызов инструментов
Рассуждение
Структурированный вывод
Работа с изображениями
Ввод
0,15 $/ 1M
Ввод из кэша
0,02 $/ 1M
Вывод
0,47 $/ 1M

Прайс-лист, состояние на 12 сентября 2026 г.. Без минимального объёма и без подписки.

О модели

Разработчик
Qwen (Alibaba)
Выпущена
август 2026 г.
Лицензия
Qwen Community License 1.0
Архитектура
смесь экспертов · 125 млрд параметров, 6 млрд активны на токен
Принимает на вход
текст, изображения, видео
Рассуждение
включается и выключается в запросе
Языки, названные разработчиком
в карточке модели не указаны

Источник: карточка модели у разработчика, состояние на 17 сентября 2026 года.

Лицензия: что она означает для вашей компании

Qwen Community License 1.0. Лицензия по образцу MIT с двумя условиями: продукты с аудиторией более 100 млн активных пользователей в месяц или выручкой свыше 20 млн долларов США в месяц обязаны указывать название модели, а бизнесу, который предоставляет модель как сервис или как ИИ-ассистента для работы, нужна отдельная лицензия от Qwen. На внутреннее использование без доступа третьих лиц эти условия не распространяются.

Краткий пересказ лицензии, а не юридическая консультация.

Технические характеристики

Окно контекста
256K токенов
Максимум на выходе
16 384 токенов
Предел пропускной способности
200K ток/мин
Токенизатор
Qwen
Потоковая выдача
да
Открытые веса
Qwen/Qwen3.8-Flash-Next
Поддерживаемые параметры
max_tokens
1 … 16384
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Куплено для вас, счёт от нас

Эта модель исполняется через глобальных поставщиков по нашему европейскому договору: один договор об обработке с компанией из ЕС, один счёт на все модели, без американского контрагента в ваших документах. Вычисление может идти за пределами ЕЭЗ — там, где нужна обработка строго в ЕЭЗ, подходит наша модель на своём железе.

Вопросы об этой модели

Где считается Qwen3.8 Flash-Next?

За пределами ЕЭЗ, через глобального поставщика по нашему европейскому договору. У вас один договор об обработке с компанией из ЕС и один счёт, но само вычисление идёт не в ЕЭЗ — мы говорим это прямо, а не умалчиваем.

Сохраняет ли Qwen3.8 Flash-Next запросы и ответы?

Нет. Модель работает без хранения данных: содержимое запросов не пишется в долговременное хранилище и ничего из него не идёт на обучение.

Насколько велико окно контекста у Qwen3.8 Flash-Next?

256K токенов, из них до 16 384 токенов на выходе.

Сколько стоит Qwen3.8 Flash-Next?

0,15 $ за миллион токенов входа и 0,47 $ за миллион токенов выхода. Без минимального объёма и подписки; один прайс-лист для интерфейса и для счёта.

Есть ли у Qwen3.8 Flash-Next предел пропускной способности?

Да, 200K токенов в минуту. Более высокий предел — вопрос объёма, а не принципа.

Понимает ли Qwen3.8 Flash-Next русский язык?

В карточке модели языки не названы — значит, и русский прямо не заявлен. Проверьте модель на своих русскоязычных материалах, прежде чем на неё полагаться.

Под какой лицензией выпущена модель Qwen3.8 Flash-Next?

Qwen Community License 1.0. Лицензия по образцу MIT с двумя условиями: продукты с аудиторией более 100 млн активных пользователей в месяц или выручкой свыше 20 млн долларов США в месяц обязаны указывать название модели, а бизнесу, который предоставляет модель как сервис или как ИИ-ассистента для работы, нужна отдельная лицензия от Qwen. На внутреннее использование без доступа третьих лиц эти условия не распространяются.

Можно ли отключить рассуждение у Qwen3.8 Flash-Next?

Да. По данным разработчика, рассуждение можно включить или выключить отдельно для каждого запроса.

Сравнение с похожими моделями

МодельРазработчикПараметрыКонтекстЛицензияВвод / 1 млн
Qwen3.8 Flash-NextQwen (Alibaba)125B / 6B256KQwen Community License 1.00,15 $
Qwen3 Next 80B A3B InstructQwen (Alibaba)80B / 3B256KApache-2.00,14 $
Qwen3 Coder NextQwen (Alibaba)80B / 3B256KApache-2.00,19 $
Qwen3.6 35B A3BQwen (Alibaba)35B / 3B256KApache-2.00,15 $

30 моделей ещё — по тому же ключу и в том же счёте.

Смотреть каталог

Обновлено: