Katalog
Metaweitergereicht

Llama 3.1 8B Instruct

Llama 3.1 8B Instruct ist Metas kleines dichtes Modell vom Juli 2024 unter der Llama 3.1 Community License. Ein Dialogmodell im Assistentenstil mit offizieller Unterstützung für acht Sprachen, darunter Deutsch, und ohne Denkmodus. Eine ältere Generation, aber weit verbreitet und günstig — eine Vergleichsbasis für einfache Dialoge, Umformulieren und Klassifizieren, nicht für mehrstufige Aufgaben. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: llama-3.1-8b-instruct

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="llama-3.1-8b-instruct",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
128K Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,08 $/ 1M
Eingabe aus Cache
0,10 $/ 1M
Ausgabe
0,12 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
Meta
Veröffentlicht
Juli 2024
Lizenz
Llama 3.1 Community License
Architektur
dicht · 8 Mrd. Parameter
Eingabe
Text
Denkmodus
nicht vorhanden
Vom Entwickler genannte Sprachen
Englisch, Deutsch, Französisch, Italienisch, Portugiesisch, Hindi, Spanisch, Thailändisch

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Lizenz: was sie für Ihr Unternehmen bedeutet

Llama 3.1 Community License. Metas eigene Community-Lizenz, keine Open-Source-Lizenz: Gewerbliche Nutzung ist nach ihren Bedingungen und der Acceptable Use Policy von Meta erlaubt; wer die Gewichte herunterlädt, muss beidem zustimmen. Für Sprachen, die Meta nicht aufführt, liegt die Verantwortung laut Modellkarte bei denen, die das Modell einsetzen.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Technische Angaben

Kontextfenster
128K Token
Maximale Ausgabe
65 536 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
Other
Streaming
ja
Offene Gewichte
meta-llama/llama-3.1-8b-instruct
Unterstützte Parameter
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird Llama 3.1 8B Instruct berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert Llama 3.1 8B Instruct Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von Llama 3.1 8B Instruct?

128K Token, davon bis zu 65 536 Token Ausgabe.

Was kostet Llama 3.1 8B Instruct?

0,08 $ je Million Token Eingabe und 0,12 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei Llama 3.1 8B Instruct eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht Llama 3.1 8B Instruct Deutsch?

Ja — der Entwickler führt Deutsch unter den unterstützten Sprachen auf: Englisch, Deutsch, Französisch, Italienisch, Portugiesisch, Hindi, Spanisch, Thailändisch.

Unter welcher Lizenz steht Llama 3.1 8B Instruct?

Llama 3.1 Community License. Metas eigene Community-Lizenz, keine Open-Source-Lizenz: Gewerbliche Nutzung ist nach ihren Bedingungen und der Acceptable Use Policy von Meta erlaubt; wer die Gewichte herunterlädt, muss beidem zustimmen. Für Sprachen, die Meta nicht aufführt, liegt die Verantwortung laut Modellkarte bei denen, die das Modell einsetzen.

Lässt sich der Denkmodus von Llama 3.1 8B Instruct abschalten?

Llama 3.1 8B Instruct hat keinen Denkmodus und antwortet direkt — das hält Latenz und Zahl der Ausgabetoken niedrig.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
Llama 3.1 8B InstructMeta8B128KLlama 3.1 Community License0,08 $
Llama 3.3 70B InstructMeta70B128KLlama 3.3 Community License0,15 $
Granite 4.2 8BIBM8B128KApache-2.00,09 $
Qwen3.5 9BQwen (Alibaba)9B256KApache-2.00,15 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: