Katalog
Qwenweitergereicht

Qwen3.8 Flash-Next

Qwen3.8 Flash-Next ist die offene Grundlage des gehosteten Qwen3.8-Flash (Qwen Community License 1.0, August 2026) und nach Angaben der Entwickler eine experimentelle Vorschau der Architektur, auf der Qwen4 aufbauen wird: Mixture-of-Experts mit 125 Mrd. Parametern, davon 6 Mrd. aktiv je Token, mit Block-Sparse-Attention. Abgestimmt ist es auf agentische Arbeit mit geringer Latenz und langem Kontext; es nimmt Text, Bilder und Video entgegen — Programmierhilfe, Analyse von Dokumenten und Codebasen, Bedienung von Desktop-Oberflächen. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: qwen3.8-flash-next

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="qwen3.8-flash-next",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
256K Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,15 $/ 1M
Eingabe aus Cache
0,02 $/ 1M
Ausgabe
0,47 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
Qwen (Alibaba)
Veröffentlicht
August 2026
Lizenz
Qwen Community License 1.0
Architektur
Mixture of Experts · 125 Mrd. Parameter, 6 Mrd. aktiv je Token
Eingabe
Text, Bilder, Video
Denkmodus
je Anfrage schaltbar
Vom Entwickler genannte Sprachen
keine Angabe auf der Modellkarte

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Lizenz: was sie für Ihr Unternehmen bedeutet

Qwen Community License 1.0. Eine an die MIT-Lizenz angelehnte Lizenz mit zwei Bedingungen: Produkte mit mehr als 100 Millionen monatlich aktiven Nutzern oder mehr als 20 Millionen US-Dollar Monatsumsatz müssen den Modellnamen anzeigen, und wer das Modell als Dienst oder als KI-Arbeitsassistenten anbietet, braucht eine gesonderte Lizenz von Qwen. Interne Nutzung ohne Zugang für Dritte ist von diesen Bedingungen ausgenommen.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Technische Angaben

Kontextfenster
256K Token
Maximale Ausgabe
16 384 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
Qwen
Streaming
ja
Offene Gewichte
Qwen/Qwen3.8-Flash-Next
Unterstützte Parameter
max_tokens
1 … 16384
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird Qwen3.8 Flash-Next berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert Qwen3.8 Flash-Next Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von Qwen3.8 Flash-Next?

256K Token, davon bis zu 16 384 Token Ausgabe.

Was kostet Qwen3.8 Flash-Next?

0,15 $ je Million Token Eingabe und 0,47 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei Qwen3.8 Flash-Next eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht Qwen3.8 Flash-Next Deutsch?

Die Modellkarte nennt keine Sprachen, also auch Deutsch nicht ausdrücklich. Prüfen Sie das Modell an eigenen deutschen Unterlagen, bevor Sie sich darauf verlassen.

Unter welcher Lizenz steht Qwen3.8 Flash-Next?

Qwen Community License 1.0. Eine an die MIT-Lizenz angelehnte Lizenz mit zwei Bedingungen: Produkte mit mehr als 100 Millionen monatlich aktiven Nutzern oder mehr als 20 Millionen US-Dollar Monatsumsatz müssen den Modellnamen anzeigen, und wer das Modell als Dienst oder als KI-Arbeitsassistenten anbietet, braucht eine gesonderte Lizenz von Qwen. Interne Nutzung ohne Zugang für Dritte ist von diesen Bedingungen ausgenommen.

Lässt sich der Denkmodus von Qwen3.8 Flash-Next abschalten?

Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
Qwen3.8 Flash-NextQwen (Alibaba)125B / 6B256KQwen Community License 1.00,15 $
Qwen3 Next 80B A3B InstructQwen (Alibaba)80B / 3B256KApache-2.00,14 $
Qwen3 Coder NextQwen (Alibaba)80B / 3B256KApache-2.00,19 $
Qwen3.6 35B A3BQwen (Alibaba)35B / 3B256KApache-2.00,15 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: