Llama 3.3 70B Instruct
Llama 3.3 70B Instruct — плотная модель Meta на 70 млрд параметров, декабрь 2024 года, лицензия Llama 3.3 Community License: многоязычный диалог в стиле ассистента и общая работа с текстом, без режима рассуждения. Официально поддерживаются восемь языков, русского среди них нет. Поколение старое, зато хорошо изученное: на ней отлажено множество тестовых наборов и промптов, поэтому она удобна как устойчивая точка сравнения. Исполняется через глобальных п оставщиков по нашему европейскому договору; запросы уходят только тем, кто не хранит ни ввод, ни ответы.
ID модели: llama-3.3-70b-instruct
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="llama-3.3-70b-instruct", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "llama-3.3-70b-instruct", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "llama-3.3-70b-instruct", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Прайс-лист, состояние на 12 сентября 2026 г.. Без минимального объёма и без подписки.
О модели
- Разработчик
- Meta
- Выпущена
- декабрь 2024 г.
- Лицензия
- Llama 3.3 Community License
- Архитектура
- плотная · 70 млрд параметров
- Принимает на вход
- текст
- Рассуждение
- режима рассуждения нет
- Актуальность знаний
- декабрь 2023 г.
- Языки, названные разработчиком
- английский, немецкий, французский, итальянский, португальский, хинди, испанский, тайский
Источник: карточка модели у разработчика, состояние на 17 сентября 2026 года.
Лицензия: что она означает для вашей компании
Llama 3.3 Community License. Собственная лицензия Meta для сообщества, а не открытая лицензия в строгом смысле: коммерческое использование разрешено на условиях этой лицензии и правил допустимого использования Meta (Acceptable Use Policy); чтобы скачать веса, нужно принять оба д окумента. Применение на языках, которых Meta не называет, по карточке — ответственность того, кто внедряет модель.
Краткий пересказ лицензии, а не юридическая консультация.
Результаты тестов по данным разработчика
- MMLU (CoT)
- 86
- IFEval
- 92,1
- HumanEval
- 88,4
- MGSM
- 91,1
Цифры из карточки модели, опубликованной разработчиком, — не наши замеры. Источник: huggingface.co/meta-llama/Llama-3.3-70B-Instruct
Технические харак теристики
- Окно контекста
- 128K токенов
- Максимум на выходе
- 65 536 токенов
- Предел пропускной способности
- 200K ток/мин
- Токенизатор
- Other
- Потоковая выдача
- да
- Открытые веса
- meta-llama/llama-3.3-70b-instruct
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Эта модель исполняется через глобальных поставщиков по нашему европейскому договору: один договор об обработке с компанией из ЕС, один счёт на все модели, без американского контрагента в ваших документах. Вычисление может идти за пределами ЕЭЗ — там, где нужна обработка строго в ЕЭЗ, подходит наша модель на своём железе.
Вопросы об этой модели
›Где считается Llama 3.3 70B Instruct?
За пределами ЕЭЗ, через глобального поставщика по нашему европейскому договору. У вас один договор об обработке с компанией из ЕС и один счёт, но само вычисление идёт не в ЕЭЗ — мы говорим это прямо, а не умалчиваем.
›Сохраняет ли Llama 3.3 70B Instruct запросы и ответы?
Нет. Модель работает без хранения данных: содержимое запросов не п ишется в долговременное хранилище и ничего из него не идёт на обучение.
›Насколько велико окно контекста у Llama 3.3 70B Instruct?
128K токенов, из них до 65 536 токенов на выходе.
›Сколько стоит Llama 3.3 70B Instruct?
0,15 $ за миллион токенов входа и 0,49 $ за миллион токенов выхода. Без минимального объёма и подписки; один прайс-лист для интерфейса и для счёта.
›Есть ли у Llama 3.3 70B Instruct предел пропускной способности?
Да, 200K токенов в минуту. Более высокий предел — вопрос объёма, а не принципа.
›Понимает ли Llama 3.3 70B Instruct русский язык?
Русского нет в списке разработчика (английский, немецкий, французский, итальянский, португальский, хинди, испанский, тайский). Проверьте модель на своих русскоязычных материалах, прежде чем на неё полагаться.
›Под какой лицензией выпущена модель Llama 3.3 70B Instruct?
Llama 3.3 Community License. Собственная лицензия Meta для сообщества, а не открытая лицензия в строгом смысле: коммерческое использование разрешено на условиях этой лицензии и правил допустимого использования Meta (Acceptable Use Policy); чтобы скачать веса, нужно принять оба документа. Применение на языках, которых Meta не называет, по карточке — ответственность того, кто внедряет модель.
›Можно ли отключить рассуждение у Llama 3.3 70B Instruct?
У Llama 3.3 70B Instruct нет режима рассуждения — модель отвечает сразу, поэтому задержка и число токенов вывода остаются низкими.
Сравнение с похожими моделями
| Модель | Разработчик | Параметры | Контекст | Лицензия | Ввод / 1 млн |
|---|---|---|---|---|---|
| Llama 3.3 70B Instruct | Meta | 70B | 128K | Llama 3.3 Community License | 0,15 $ |
| Llama 3.1 8B Instruct | Meta | 8B | 128K | Llama 3.1 Community License | 0,08 $ |
| Qwen3 Next 80B A3B Instruct | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,14 $ |
| Qwen3 Coder Next | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,19 $ |
30 моделей ещё — по тому же ключу и в том же счёте.
Смотреть каталогОбновлено: