Qwen3.8 Flash-Next
Qwen3.8 Flash-Next — открытая основа размещённой у разработчика Qwen3.8-Flash (лицензия Qwen Community License 1.0, август 2026) и, по словам авторов, экспериментальный предпросмотр архитектуры будущей Qwen4: «смесь экспертов» на 125 млрд параметров, 6 млрд активны на токен, с блочно-разреженным вниманием. Настроена на агентскую работу с малой задержкой на длинном контексте; принимает текст, изображения и видео — помощь в программировании, разбор документов и кодовых баз, управление интерфейсом. Исполняется через глобальных поставщиков по нашему европейскому договору; запросы уходят только тем, кто не хранит ни ввод, ни ответы.
ID модели: qwen3.8-flash-next
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="qwen3.8-flash-next", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen3.8-flash-next", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "qwen3.8-flash-next", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Прайс-лист, состояние на 12 сентября 2026 г.. Без минимального объёма и без подписки.
О модели
- Разработчик
- Qwen (Alibaba)
- Выпущена
- август 2026 г.
- Лицензия
- Qwen Community License 1.0
- Архитектура
- смесь экспертов · 125 млрд параметров, 6 млрд активны на токен
- Принимает на вход
- текст, изображения, видео
- Рассуждение
- включается и выключается в запросе
- Языки, названные разработчиком
- в карточке модели не указаны
Источник: карточка модели у разработчика, состояние на 17 сентября 2026 года.
Лицензия: что она означает для вашей компании
Qwen Community License 1.0. Лицензия по образцу MIT с двумя условиями: продукты с аудиторией более 100 млн активных пользователей в месяц или выручкой свыше 20 млн долларов США в месяц обязаны указывать название модели, а бизнесу, который предоставляет модель как сервис или как ИИ-ассистента для работы, нужна отдельная лицензия от Qwen. На внутреннее использование без доступа третьих лиц эт и условия не распространяются.
Краткий пересказ лицензии, а не юридическая консультация.
Технические характеристики
- Окно контекста
- 256K токенов
- Максимум на выходе
- 16 384 токенов
- Предел пропускной способности
- 200K ток/мин
- Токенизатор
- Qwen
- Потоковая выдача
- да
- Открытые веса
- Qwen/Qwen3.8-Flash-Next
- max_tokens
- 1 … 16384
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Эта модель исполняется через глобальных поставщиков по нашему европейскому договору: один договор об обработке с компанией из ЕС, один счёт на все модели, без американского контрагента в ваших документах. Вычисление может идти за пределами ЕЭЗ — там, где нужна обработка строго в ЕЭЗ, подходит наша модель на своём железе.
Вопросы об этой модели
›Где считается Qwen3.8 Flash-Next?
За пределами ЕЭЗ, через глобального поставщика по нашему европейскому договору. У вас один договор об обработке с компанией из ЕС и один счёт, но само вычисление идёт не в ЕЭЗ — мы говорим это прямо, а не умалчиваем.
›Сохраняет ли Qwen3.8 Flash-Next запросы и ответы?
Нет. Модель работает без хранения данных: содержимое запросов не пишется в долговременное хранилище и ничего из него не идёт на обучение.
›Насколько велико окно контекста у Qwen3.8 Flash-Next?
256K токенов, из них до 16 384 токенов на выходе.
›Сколько стоит Qwen3.8 Flash-Next?
0,15 $ за миллион токенов входа и 0,47 $ за миллион токенов выхода. Без минимального объёма и подписки; один прайс-лист для интерфейса и для счёта.
›Есть ли у Qwen3.8 Flash-Next предел пропускной способности?
Да, 200K токенов в минуту. Более высокий предел — вопрос объёма, а не принципа.
›Понимает ли Qwen3.8 Flash-Next русский язык?
В карточке модели языки не названы — значит, и русский прямо не заявлен. Проверьте модель на своих русскоязычных материалах, прежде чем на неё полагаться.
›Под какой лицензией выпущена модель Qwen3.8 Flash-Next?
Qwen Community License 1.0. Лицензия по образцу MIT с двумя условиями: продукты с аудиторией более 100 млн активных пользователей в месяц или выручкой свыше 20 млн долларов США в месяц обязаны указывать название модели, а бизнесу, который предоставляет модель как сервис или как ИИ-ассистента для работы, нужна отдельная лицензия от Qwen. На внутреннее использование без доступа третьих лиц эти условия не распространяются.
›Можно ли отключить рассуждение у Qwen3.8 Flash-Next?
Да. По данным разработчика, рассуждение можно включить или выключить отдельно для каждого запроса.
Сравнение с похожими моделями
| Модель | Разработчик | Параметры | Контекст | Лицензия | Ввод / 1 млн |
|---|---|---|---|---|---|
| Qwen3.8 Flash-Next | Qwen (Alibaba) | 125B / 6B | 256K | Qwen Community License 1.0 | 0,15 $ |
| Qwen3 Next 80B A3B Instruct | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,14 $ |
| Qwen3 Coder Next | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,19 $ |
| Qwen3.6 35B A3B | Qwen (Alibaba) | 35B / 3B | 256K | Apache-2.0 | 0,15 $ |
30 моделей ещё — по тому же ключу и в том же счёте.
Смотреть каталогОбновлено: