Llama 3.3 70B Instruct
Llama 3.3 70B Instruct ist Metas dichtes 70-Mrd.-Modell vom Dezember 2024 unter der Llama 3.3 Community License: mehrsprachiger Dialog im Assistentenstil und allgemeine Textarbeit, offiziell auch auf Deutsch, ohne Denkmodus. Eine ältere Generation, dafür gut erforscht — viele Evaluationssätze und Prompts wurden darauf abgestimmt, was es zu einem stabilen Bezugspunkt für Vergleiche macht. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.
Modell-ID: llama-3.3-70b-instruct
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="llama-3.3-70b-instruct", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "llama-3.3-70b-instruct", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "llama-3.3-70b-instruct", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- Meta
- Veröffentlicht
- Dezember 2024
- Lizenz
- Llama 3.3 Community License
- Architektur
- dicht · 70 Mrd. Parameter
- Eingabe
- Text
- Denkmodus
- nicht vorhanden
- Wissensstand
- Dezember 2023
- Vom Entwickler genannte Sprachen
- Englisch, Deutsch, Französisch, Italienisch, Portugiesisch, Hindi, Spanisch, Thailändisch
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Lizenz: was sie für Ihr Unternehmen bedeutet
Llama 3.3 Community License. Metas eigene Community-Lizenz, keine Open-Source-Lizenz: Gewerbliche Nutzung ist nach ihren Bedingungen und der Acceptable Use Policy von Meta erlaubt; wer die Gewichte herunterlädt, muss beidem zustimmen. Für Sprachen, die Meta nicht aufführt, liegt die Verantwortung laut Modellkarte bei denen, die das Modell einsetzen.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Benchmark-Ergebnisse laut Entwickler
- MMLU (CoT)
- 86
- IFEval
- 92,1
- HumanEval
- 88,4
- MGSM
- 91,1
Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/meta-llama/Llama-3.3-70B-Instruct
Technische Angaben
- Kontextfenster
- 128K Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 200K Tok/min
- Tokenizer
- Other
- Streaming
- ja
- Offene Gewichte
- meta-llama/llama-3.3-70b-instruct
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird Llama 3.3 70B Instruct berechnet?
Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.
›Speichert Llama 3.3 70B Instruct Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Llama 3.3 70B Instruct?
128K Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet Llama 3.3 70B Instruct?
0,15 $ je Million Token Eingabe und 0,49 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Llama 3.3 70B Instruct eine Durchsatzgrenze?
Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Llama 3.3 70B Instruct Deutsch?
Ja — der Entwickler führt Deutsch unter den unterstützten Sprachen auf: Englisch, Deutsch, Französisch, Italienisch, Portugiesisch, Hindi, Spanisch, Thailändisch.
›Unter welcher Lizenz steht Llama 3.3 70B Instruct?
Llama 3.3 Community License. Metas eigene Community-Lizenz, keine Open-Source-Lizenz: Gewerbliche Nutzung ist nach ihren Bedingungen und der Acceptable Use Policy von Meta erlaubt; wer die Gewichte herunterlädt, muss beidem zustimmen. Für Sprachen, die Meta nicht aufführt, liegt die Verantwortung laut Modellkarte bei denen, die das Modell einsetzen.
›Lässt sich der Denkmodus von Llama 3.3 70B Instruct abschalten?
Llama 3.3 70B Instruct hat keinen Denkmodus und antwortet direkt — das hält Latenz und Zahl der Ausgabetoken niedrig.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Llama 3.3 70B Instruct | Meta | 70B | 128K | Llama 3.3 Community License | 0,15 $ |
| Llama 3.1 8B Instruct | Meta | 8B | 128K | Llama 3.1 Community License | 0,08 $ |
| Qwen3 Next 80B A3B Instruct | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,14 $ |
| Qwen3 Coder Next | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,19 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: