Nemotron 3 Super 120B A12B
Nemotron 3 Super 120B A12B ist NVIDIAs größeres Hybridmodell (NVIDIA Nemotron Open Model License, März 2026): 120 Mrd. Parameter, davon 12 Mrd. aktiv, mit State-Space-, Mixture-of-Experts- und Attention-Schichten. Es zielt auf agentische Abläufe, Schlussfolgern über langen Kontext, Werkzeugnutzung, Retrieval-Augmented Generation und Aufgaben mit hohem Volumen wie die Ticket-Automatisierung; die Modellkarte nennt 91,75 Punkte im Langkontext-Test RULER bei einer Million Token. Deutsch gehört zu den unterstützten Sprachen. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.
Modell-ID: nemotron-3-super-120b-a12b
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="nemotron-3-super-120b-a12b", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "nemotron-3-super-120b-a12b", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "nemotron-3-super-120b-a12b", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- NVIDIA
- Veröffentlicht
- März 2026
- Lizenz
- NVIDIA Nemotron Open Model License
- Architektur
- Mixture of Experts · 120 Mrd. Parameter, 12 Mrd. aktiv je Token
- Eingabe
- Text
- Denkmodus
- je Anfrage schaltbar
- Vom Entwickler genannte Sprachen
- Englisch, Französisch, Deutsch, Italienisch, Japanisch, Spanisch, Chinesisch
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Lizenz: was sie für Ihr Unternehmen bedeutet
NVIDIA Nemotron Open Model License. NVIDIAs eigene Lizenz für offene Modelle, keine Standard-Open-Source-Lizenz. NVIDIA bezeichnet das Modell als bereit für den gewerblichen Einsatz; die Bedingungen für die Weitergabe von Gewichten oder abgeleiteten Modellen stehen in der Lizenz selbst.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Benchmark-Ergebnisse laut Entwickler
- RULER (1M)
- 91,75
Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16
Technische Angaben
- Kontextfenster
- 256K Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 200K Tok/min
- Tokenizer
- Other
- Streaming
- ja
- Offene Gewichte
- nvidia/nemotron-3-super-120b-a12b
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird Nemotron 3 Super 120B A12B berechnet?
Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.
›Speichert Nemotron 3 Super 120B A12B Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Nemotron 3 Super 120B A12B?
256K Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet Nemotron 3 Super 120B A12B?
0,13 $ je Million Token Eingabe und 0,62 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Nemotron 3 Super 120B A12B eine Durchsatzgrenze?
Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Nemotron 3 Super 120B A12B Deutsch?
Ja — der Entwickler führt Deutsch unter den unterstützten Sprachen auf: Englisch, Französisch, Deutsch, Italienisch, Japanisch, Spanisch, Chinesisch.
›Unter welcher Lizenz steht Nemotron 3 Super 120B A12B?
NVIDIA Nemotron Open Model License. NVIDIAs eigene Lizenz für offene Modelle, keine Standard-Open-Source-Lizenz. NVIDIA bezeichnet das Modell als bereit für den gewerblichen Einsatz; die Bedingungen für die Weitergabe von Gewichten oder abgeleiteten Modellen stehen in der Lizenz selbst.
›Lässt sich der Denkmodus von Nemotron 3 Super 120B A12B abschalten?
Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Nemotron 3 Super 120B A12B | NVIDIA | 120B / 12B | 256K | NVIDIA Nemotron Open Model License | 0,13 $ |
| Nemotron 3.5 Lightning | NVIDIA | 30B / 3B | 256K | OpenMDW-1.1 | 0,12 $ |
| Laguna S 2.1 | Poolside | 118B / 8B | 1M | OpenMDW-1.1 | 0,09 $ |
| gpt-oss-120b | OpenAI | 117B / 5,1B | 128K | Apache-2.0 | 0,11 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: