Katalog
DeepSeekweitergereicht

DeepSeek-V4.1-Flash

DeepSeek-V4.1-Flash (MIT-Lizenz, September 2026) ist ein multimodales Mixture-of-Experts-Modell und ein anderes Netz als V4-Flash: ein Backbone mit 552 Mrd. Parametern, das beim Lesen der Eingabe 8 Mrd. und beim Erzeugen der Ausgabe 16 Mrd. je Token aktiviert. DeepSeek hat es für eingabelastige agentische Arbeit gebaut — Code-Agenten, Werkzeugnutzung, Agenten, die Bildschirminhalte auswerten. Der Speicherbedarf bleibt auch bei einem Kontext von einer Million Token gering. Der Denkaufwand ist stufenlos von 1 bis 100 regelbar. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: deepseek-v4.1-flash

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="deepseek-v4.1-flash",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
1M Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,15 $/ 1M
Ausgabe
0,60 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
DeepSeek
Veröffentlicht
September 2026
Lizenz
MIT
Architektur
Mixture of Experts · 552 Mrd. Parameter, 8–16 Mrd. aktiv je Token
Eingabe
Text, Bilder
Denkmodus
Aufwand wählbar
Vom Entwickler genannte Sprachen
keine Angabe auf der Modellkarte

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Welches DeepSeek-Modell passt?

DeepSeek V4 Flash ist die Vorschauversion vom April 2026. DeepSeek-V4-Flash-0731 ist die offizielle Version (284 Mrd. Parameter, 13 Mrd. aktiv, nur Text) und die naheliegende erste Wahl für Code- und Werkzeugagenten bei moderaten Kosten.

DeepSeek-V4-Pro-0813 ist das Spitzenmodell: 1,6 Billionen Parameter, davon 49 Mrd. aktiv. DeepSeek empfiehlt, bei hohem und maximalem Denkaufwand bis zu 384.000 Ausgabetoken zuzulassen — die maximale Ausgabe bei uns steht unter „Technische Angaben“.

DeepSeek-V4.1-Flash (September 2026) ist ein eigenständiges neues Modell und keine Zwischenversion: 552 Mrd. Parameter, 8 Mrd. aktiv beim Lesen und 16 Mrd. beim Erzeugen der Ausgabe, mit Bildeingabe. Es eignet sich für Agenten mit viel Eingabe; an der Vorschauversion sollten Sie nur festhalten, wenn Sie frühere Ergebnisse reproduzieren müssen.

Alle vier haben offene Gewichte und stehen unter der MIT-Lizenz.

Lizenz: was sie für Ihr Unternehmen bedeutet

MIT. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Technische Angaben

Kontextfenster
1M Token
Maximale Ausgabe
65 536 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
DeepSeek
Streaming
ja
Offene Gewichte
deepseek-ai/DeepSeek-V4.1-Flash
Unterstützte Parameter
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird DeepSeek-V4.1-Flash berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert DeepSeek-V4.1-Flash Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von DeepSeek-V4.1-Flash?

1M Token, davon bis zu 65 536 Token Ausgabe.

Was kostet DeepSeek-V4.1-Flash?

0,15 $ je Million Token Eingabe und 0,60 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei DeepSeek-V4.1-Flash eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht DeepSeek-V4.1-Flash Deutsch?

Die Modellkarte nennt keine Sprachen, also auch Deutsch nicht ausdrücklich. Prüfen Sie das Modell an eigenen deutschen Unterlagen, bevor Sie sich darauf verlassen.

Unter welcher Lizenz steht DeepSeek-V4.1-Flash?

MIT. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Lässt sich der Denkmodus von DeepSeek-V4.1-Flash abschalten?

Der Entwickler lässt den Denkaufwand wählen; ein vollständiges Abschalten beschreibt die Modellkarte nicht.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
DeepSeek-V4.1-FlashDeepSeek552B / 8–161MMIT0,15 $
DeepSeek-V4-Flash-0731DeepSeek284B / 13B1.3MMIT0,06 $
DeepSeek V4 FlashDeepSeek284B / 13B1MMIT0,25 $
DeepSeek-V4-Pro-0813DeepSeek1,6T / 49B1MMIT0,80 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: