Katalog
NVIDIAweitergereicht

Nemotron 3 Super 120B A12B

Nemotron 3 Super 120B A12B ist NVIDIAs größeres Hybridmodell (NVIDIA Nemotron Open Model License, März 2026): 120 Mrd. Parameter, davon 12 Mrd. aktiv, mit State-Space-, Mixture-of-Experts- und Attention-Schichten. Es zielt auf agentische Abläufe, Schlussfolgern über langen Kontext, Werkzeugnutzung, Retrieval-Augmented Generation und Aufgaben mit hohem Volumen wie die Ticket-Automatisierung; die Modellkarte nennt 91,75 Punkte im Langkontext-Test RULER bei einer Million Token. Deutsch gehört zu den unterstützten Sprachen. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: nemotron-3-super-120b-a12b

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="nemotron-3-super-120b-a12b",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
256K Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,13 $/ 1M
Eingabe aus Cache
0,13 $/ 1M
Ausgabe
0,62 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
NVIDIA
Veröffentlicht
März 2026
Lizenz
NVIDIA Nemotron Open Model License
Architektur
Mixture of Experts · 120 Mrd. Parameter, 12 Mrd. aktiv je Token
Eingabe
Text
Denkmodus
je Anfrage schaltbar
Vom Entwickler genannte Sprachen
Englisch, Französisch, Deutsch, Italienisch, Japanisch, Spanisch, Chinesisch

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Lizenz: was sie für Ihr Unternehmen bedeutet

NVIDIA Nemotron Open Model License. NVIDIAs eigene Lizenz für offene Modelle, keine Standard-Open-Source-Lizenz. NVIDIA bezeichnet das Modell als bereit für den gewerblichen Einsatz; die Bedingungen für die Weitergabe von Gewichten oder abgeleiteten Modellen stehen in der Lizenz selbst.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Benchmark-Ergebnisse laut Entwickler

RULER (1M)
91,75

Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16

Technische Angaben

Kontextfenster
256K Token
Maximale Ausgabe
65 536 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
Other
Streaming
ja
Offene Gewichte
nvidia/nemotron-3-super-120b-a12b
Unterstützte Parameter
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird Nemotron 3 Super 120B A12B berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert Nemotron 3 Super 120B A12B Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von Nemotron 3 Super 120B A12B?

256K Token, davon bis zu 65 536 Token Ausgabe.

Was kostet Nemotron 3 Super 120B A12B?

0,13 $ je Million Token Eingabe und 0,62 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei Nemotron 3 Super 120B A12B eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht Nemotron 3 Super 120B A12B Deutsch?

Ja — der Entwickler führt Deutsch unter den unterstützten Sprachen auf: Englisch, Französisch, Deutsch, Italienisch, Japanisch, Spanisch, Chinesisch.

Unter welcher Lizenz steht Nemotron 3 Super 120B A12B?

NVIDIA Nemotron Open Model License. NVIDIAs eigene Lizenz für offene Modelle, keine Standard-Open-Source-Lizenz. NVIDIA bezeichnet das Modell als bereit für den gewerblichen Einsatz; die Bedingungen für die Weitergabe von Gewichten oder abgeleiteten Modellen stehen in der Lizenz selbst.

Lässt sich der Denkmodus von Nemotron 3 Super 120B A12B abschalten?

Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
Nemotron 3 Super 120B A12BNVIDIA120B / 12B256KNVIDIA Nemotron Open Model License0,13 $
Nemotron 3.5 LightningNVIDIA30B / 3B256KOpenMDW-1.10,12 $
Laguna S 2.1Poolside118B / 8B1MOpenMDW-1.10,09 $
gpt-oss-120bOpenAI117B / 5,1B128KApache-2.00,11 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: