Llama 3.1 8B Instruct
Llama 3.1 8B Instruct — небольшая плотная модель Meta, июль 2024 года, лицензия Llama 3.1 Community License. Диалоговая модель в стиле ассистента с официальной поддержкой восьми языков (английский, немецкий, французский, итальянский, португальский, хинди, испанский, тайский) и без режима рассуждения. Русского в официальном списке нет — использование за его пределами Meta оставляет на ответственности разработчика. Старое поколение, но дешёвое и поддержи вается почти везде. Исполняется через глобальных поставщиков по нашему европейскому договору; запросы уходят только тем, кто не хранит ни ввод, ни ответы.
ID модели: llama-3.1-8b-instruct
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="llama-3.1-8b-instruct", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "llama-3.1-8b-instruct", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "llama-3.1-8b-instruct", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Прайс-лист, состояние на 12 сентября 2026 г.. Без минимального объёма и без подписки.
О модели
- Разработчик
- Meta
- Выпущена
- июль 2024 г.
- Лицензия
- Llama 3.1 Community License
- Архитектура
- плотная · 8 млрд параметров
- Принимает на вход
- текст
- Рассуждение
- режима рассуждения нет
- Языки, названные разработчиком
- английский, немецкий, французский, итальянский, португальский, хинди, испанский, тайский
Источник: карточка модели у разработчика, состояние на 17 сентября 2026 года.
Лицензия: что она означает для вашей компании
Llama 3.1 Community License. Собственная лицензия Meta для сообщества, а не открытая лицензия в строгом смысле: коммерческое использование разрешено на условиях этой лицензии и правил допустимого использования Meta (Acceptable Use Policy); чтобы скачать веса, нужно принять оба документа. Применение на языках, которых Meta не называет, по карточке — ответственность того, кто внедр яет модель.
Краткий пересказ лицензии, а не юридическая консультация.
Технические характеристики
- Окно контекста
- 128K токенов
- Максимум на выходе
- 65 536 токенов
- Предел пропускной способности
- 200K ток/мин
- Токенизатор
- Other
- Потоковая выдача
- да
- Открытые веса
- meta-llama/llama-3.1-8b-instruct
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Эта модель исполняется через глобальных поставщиков по нашему европейскому договору: один договор об обработке с компанией из ЕС, один счёт на все модели, без американского контрагента в ваших документах. Вычисление может идти за пределами ЕЭЗ — там, где нужна обработка строго в ЕЭЗ, подходит наша модель на своём железе.
Вопросы об этой модели
›Где считается Llama 3.1 8B Instruct?
За пределами ЕЭЗ, через глобального поставщика по нашему европейскому договору. У вас один договор об обработке с компанией из ЕС и один счёт, но само вычисление идёт не в ЕЭЗ — мы говорим это прямо, а не умалчиваем.
›Сохраняет ли Llama 3.1 8B Instruct запросы и ответы?
Нет. Модель работает без хранения данных: содержимое запросов не пишется в долговременное хранилище и ничего из него не идёт на обучение.
›Насколько велико окно контекста у Llama 3.1 8B Instruct?
128K токенов, из них до 65 536 токенов на выходе.
›Сколько стоит Llama 3.1 8B Instruct?
0,08 $ за миллион токенов входа и 0,12 $ за миллион токенов выхода. Без минимального объёма и подписки; один прайс-лист для интерфейса и для счёта.
›Есть ли у Llama 3.1 8B Instruct предел пропускной способности?
Да, 200K токенов в минуту. Более высокий предел — вопрос объёма, а не принципа.
›Понимает ли Llama 3.1 8B Instruct русский язык?
Русского нет в списке разработчика (английский, немецкий, французский, итальянский, португальский, хинди, испанский, тайский). Проверьте модель на своих русскоязычных материалах, прежде чем на неё полагаться.
›Под какой лицензией выпущена модель Llama 3.1 8B Instruct?
Llama 3.1 Community License. Собственная лицензия Meta для сообщества, а не открытая лицензия в строгом смысле: коммерческое использование разрешено на условиях этой лицензии и правил допустимого использования Meta (Acceptable Use Policy); чтобы скачать веса, нужно принять оба документа. Применение на языках, которых Meta не называет, по карточке — ответственность того, кто внедряет модель.
›Можно ли отключить рассуждение у Llama 3.1 8B Instruct?
У Llama 3.1 8B Instruct нет режима рассуждения — модель отвечает сразу, поэтому задержка и число токенов вывода остаются низкими.
Сравнение с похожими моделями
| Модель | Разработчик | Параметры | Контекст | Лицензия | Ввод / 1 млн |
|---|---|---|---|---|---|
| Llama 3.1 8B Instruct | Meta | 8B | 128K | Llama 3.1 Community License | 0,08 $ |
| Llama 3.3 70B Instruct | Meta | 70B | 128K | Llama 3.3 Community License | 0,15 $ |
| Granite 4.2 8B | IBM | 8B | 128K | Apache-2.0 | 0,09 $ |
| Qwen3.5 9B | Qwen (Alibaba) | 9B | 256K | Apache-2.0 | 0,15 $ |
30 моделей ещё — по тому же ключу и в том же счёте.
Смотреть каталогОбновлено: