Qwen3 Next 80B A3B Instruct
Qwen3 Next 80B A3B Instruct (Apache 2.0, September 2025) ist das Effizienzexperiment des Qwen-Teams: 80 Mrd. Parameter, davon nur 3 Mrd. aktiv je Token, dank einer Mischung aus Linear Attention und Gated Attention. Es antwortet direkt — ohne Denkmodus und ohne ausgegebene Überlegungen — und spielt seinen Vorteil bei sehr langen Eingaben aus. Die Entwickler berichten bei mehreren Benchmarks von Ergebnissen auf dem Niveau ihres weit größeren 235-Mrd.-Modells. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.
Modell-ID: qwen3-next-80b-a3b-instruct
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="qwen3-next-80b-a3b-instruct", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen3-next-80b-a3b-instruct", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "qwen3-next-80b-a3b-instruct", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- Qwen (Alibaba)
- Veröffentlicht
- September 2025
- Lizenz
- Apache-2.0
- Architektur
- Mixture of Experts · 80 Mrd. Parameter, 3 Mrd. aktiv je Token
- Eingabe
- Text
- Denkmodus
- nicht vorhanden
- Vom Entwickler genannte Sprachen
- keine Angabe auf der Modellkarte
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Lizenz: was sie für Ihr Unternehmen bedeutet
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Technische Angaben
- Kontextfenster
- 256K Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 200K Tok/min
- Tokenizer
- Other
- Streaming
- ja
- Offene Gewichte
- Qwen/Qwen3-Next-80B-A3B-Instruct
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird Qwen3 Next 80B A3B Instruct berechnet?
Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.
›Speichert Qwen3 Next 80B A3B Instruct Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Qwen3 Next 80B A3B Instruct?
256K Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet Qwen3 Next 80B A3B Instruct?
0,14 $ je Million Token Eingabe und 1,70 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Qwen3 Next 80B A3B Instruct eine Durchsatzgrenze?
Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Qwen3 Next 80B A3B Instruct Deutsch?
Die Modellkarte nennt keine Sprachen, also auch Deutsch nicht ausdrücklich. Prüfen Sie das Modell an eigenen deutschen Unterlagen, bevor Sie sich darauf verlassen.
›Unter welcher Lizenz steht Qwen3 Next 80B A3B Instruct?
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
›Lässt sich der Denkmodus von Qwen3 Next 80B A3B Instruct abschalten?
Qwen3 Next 80B A3B Instruct hat keinen Denkmodus und antwortet direkt — das hält Latenz und Zahl der Ausgabetoken niedrig.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Qwen3 Next 80B A3B Instruct | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,14 $ |
| Qwen3 Coder Next | Qwen (Alibaba) | 80B / 3B | 256K | Apache-2.0 | 0,19 $ |
| Qwen3.8 Flash-Next | Qwen (Alibaba) | 125B / 6B | 256K | Qwen Community License 1.0 | 0,15 $ |
| Qwen3.6 35B A3B | Qwen (Alibaba) | 35B / 3B | 256K | Apache-2.0 | 0,15 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: