Nemotron 3.5 Lightning
Nemotron 3.5 Lightning ist NVIDIAs kleines Hybridmodell (Lizenz OpenMDW 1.1, August 2026): 30 Mrd. Parameter, davon 3 Mrd. aktiv je Token, mit einer Mischung aus State-Space- und Mixture-of-Experts-Schichten für hohen Durchsatz. NVIDIA beschreibt es als Allzweckmodell für Schlussfolgern und Dialog – für Agentensysteme, Chatbots, Retrieval-Augmented Generation (RAG) und das Befolgen von Anweisungen. Unterstützt werden Englisch, Spanisch, Französisch, Deutsch, Italienisch und Japanisch; der Denkmodus ist abschaltbar. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.
Modell-ID: nemotron-3.5-lightning
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="nemotron-3.5-lightning", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "nemotron-3.5-lightning", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "nemotron-3.5-lightning", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- NVIDIA
- Veröffentlicht
- August 2026
- Lizenz
- OpenMDW-1.1
- Architektur
- Mixture of Experts · 30 Mrd. Parameter, 3 Mrd. aktiv je Token
- Eingabe
- Text
- Denkmodus
- je Anfrage schaltbar
- Vom Entwickler genannte Sprachen
- Englisch, Spanisch, Französisch, Deutsch, Italienisch, Japanisch
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Lizenz: was sie für Ihr Unternehmen bedeutet
OpenMDW-1.1. OpenMDW 1.1, eine freizügige Lizenz für Modellgewichte und Daten: Laut Modellkarte dürfen Sie das Modell ohne gesonderte Genehmigung nutzen, verändern und darauf gewerbliche Produkte aufbauen.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Technische Angaben
- Kontextfenster
- 256K Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 200K Tok/min
- Tokenizer
- Other
- Streaming
- ja
- Offene Gewichte
- nvidia/nemotron-3.5-lightning
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird Nemotron 3.5 Lightning berechnet?
Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.
›Speichert Nemotron 3.5 Lightning Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Nemotron 3.5 Lightning?
256K Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet Nemotron 3.5 Lightning?
0,12 $ je Million Token Eingabe und 0,31 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Nemotron 3.5 Lightning eine Durchsatzgrenze?
Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Nemotron 3.5 Lightning Deutsch?
Ja — der Entwickler führt Deutsch unter den unterstützten Sprachen auf: Englisch, Spanisch, Französisch, Deutsch, Italienisch, Japanisch.
›Unter welcher Lizenz steht Nemotron 3.5 Lightning?
OpenMDW-1.1. OpenMDW 1.1, eine freizügige Lizenz für Modellgewichte und Daten: Laut Modellkarte dürfen Sie das Modell ohne gesonderte Genehmigung nutzen, verändern und darauf gewerbliche Produkte aufbauen.
›Lässt sich der Denkmodus von Nemotron 3.5 Lightning abschalten?
Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | NVIDIA | 30B / 3B | 256K | OpenMDW-1.1 | 0,12 $ |
| Nemotron 3 Super 120B A12B | NVIDIA | 120B / 12B | 256K | NVIDIA Nemotron Open Model License | 0,13 $ |
| GLM-4.7-Flash | Z.ai | 30B / 3B | 195K | MIT | 0,09 $ |
| Gemma 4 31B | Google DeepMind | 30,7B | 256K | Apache-2.0 | 0,14 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: