DeepSeek-V4-Flash-0731
DeepSeek-V4-Flash-0731 ist die offizielle Fassung von DeepSeek V4-Flash (MIT-Lizenz, Juli 2026) und löst die Vorschau vom April ab: ein Mixture-of-Experts-Modell mit 284 Mrd. Parametern, davon 13 Mrd. aktiv je Token, ausgelegt auf einen Kontext von einer Million Token. DeepSeek berichtet von deutlich stärkerem agentischem Verhalten — Code-Agenten und Werkzeugnutzung — und weist auf der Modellkarte 82,7 Punkte im Terminal-Bench 2.1 aus. Der Denkaufwand ist wählbar: niedrig, hoch oder maximal. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.
Modell-ID: deepseek-v4-flash-0731
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="deepseek-v4-flash-0731", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "deepseek-v4-flash-0731", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "deepseek-v4-flash-0731", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- DeepSeek
- Veröffentlicht
- Juli 2026
- Lizenz
- MIT
- Architektur
- Mixture of Experts · 284 Mrd. Parameter, 13 Mrd. aktiv je Token
- Eingabe
- Text
- Denkmodus
- Aufwand wählbar
- Vom Entwickler genannte Sprachen
- keine Angabe auf der Modellkarte
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Welches DeepSeek-Modell passt?
DeepSeek V4 Flash ist die Vorschauversion vom April 2026. DeepSeek-V4-Flash-0731 ist die offizielle Version (284 Mrd. Parameter, 13 Mrd. aktiv, nur Text) und die naheliegende erste Wahl für Code- und Werkzeugagenten bei moderaten Kosten.
DeepSeek-V4-Pro-0813 ist das Spitzenmodell: 1,6 Billionen Parameter, davon 49 Mrd. aktiv. DeepSeek empfiehlt, bei hohem und maximalem Denkaufwand bis zu 384.000 Ausgabetoken zuzulassen — die maximale Ausgabe bei uns steht unter „Technische Angaben“.
DeepSeek-V4.1-Flash (September 2026) ist ein eigenständiges neues Modell und keine Zwischenversion: 552 Mrd. Parameter, 8 Mrd. aktiv beim Lesen und 16 Mrd. beim Erzeugen der Ausgabe, mit Bildeingabe. Es eignet sich für Agenten mit viel Eingabe; an der Vorschauversion sollten Sie nur festhalten, wenn Sie frühere Ergebnisse reproduzieren müssen.
Alle vier haben offene Gewichte und stehen unter der MIT-Lizenz.
Lizenz: was sie für Ihr Unternehmen bedeutet
MIT. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Benchmark-Ergebnisse laut Entwickler
- Terminal Bench 2.1
- 82,7
- DeepSWE
- 54,4
Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
Technische Angaben
- Kontextfenster
- 1.3M Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 200K Tok/min
- Tokenizer
- DeepSeek
- Streaming
- ja
- Offene Gewichte
- deepseek-ai/DeepSeek-V4-Flash-0731
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird DeepSeek-V4-Flash-0731 berechnet?
Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.
›Speichert DeepSeek-V4-Flash-0731 Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von DeepSeek-V4-Flash-0731?
1.3M Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet DeepSeek-V4-Flash-0731?
0,06 $ je Million Token Eingabe und 0,12 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei DeepSeek-V4-Flash-0731 eine Durchsatzgrenze?
Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht DeepSeek-V4-Flash-0731 Deutsch?
Die Modellkarte nennt keine Sprachen, also auch Deutsch nicht ausdrücklich. Prüfen Sie das Modell an eigenen deutschen Unterlagen, bevor Sie sich darauf verlassen.
›Unter welcher Lizenz steht DeepSeek-V4-Flash-0731?
MIT. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
›Lässt sich der Denkmodus von DeepSeek-V4-Flash-0731 abschalten?
Der Entwickler lässt den Denkaufwand wählen; ein vollständiges Abschalten beschreibt die Modellkarte nicht.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| DeepSeek-V4-Flash-0731 | DeepSeek | 284B / 13B | 1.3M | MIT | 0,06 $ |
| DeepSeek V4 Flash | DeepSeek | 284B / 13B | 1M | MIT | 0,25 $ |
| DeepSeek-V4.1-Flash | DeepSeek | 552B / 8–16 | 1M | MIT | 0,15 $ |
| DeepSeek-V4-Pro-0813 | DeepSeek | 1,6T / 49B | 1M | MIT | 0,80 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: