Katalog
Qwenweitergereicht

Qwen3 32B

Qwen3 32B ist das dichte 32,8-Mrd.-Modell des Qwen-Teams (Apache 2.0, April 2025), das zwischen einem Denkmodus für Logik, Mathematik und Code und einem direkten Modus für zügige Dialoge wechselt. Die Entwickler nennen über 100 Sprachen und Dialekte und heben mehrsprachiges Befolgen von Anweisungen sowie Übersetzung hervor. Eine frühere Generation mit kurzem nativem Kontext, aber ein verlässlicher Allrounder für mehrsprachige Textarbeit. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: qwen3-32b

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="qwen3-32b",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
128K Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,12 $/ 1M
Eingabe aus Cache
0,12 $/ 1M
Ausgabe
0,43 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
Qwen (Alibaba)
Veröffentlicht
April 2025
Lizenz
Apache-2.0
Architektur
dicht · 32,8 Mrd. Parameter
Eingabe
Text
Denkmodus
je Anfrage schaltbar
Vom Entwickler genannte Sprachen
100+ Sprachen

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Lizenz: was sie für Ihr Unternehmen bedeutet

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Technische Angaben

Kontextfenster
128K Token
Maximale Ausgabe
65 536 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
Other
Streaming
ja
Offene Gewichte
qwen/qwen3-32b
Unterstützte Parameter
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird Qwen3 32B berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert Qwen3 32B Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von Qwen3 32B?

128K Token, davon bis zu 65 536 Token Ausgabe.

Was kostet Qwen3 32B?

0,12 $ je Million Token Eingabe und 0,43 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei Qwen3 32B eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht Qwen3 32B Deutsch?

Der Entwickler nennt über 100 Sprachen, ohne sie einzeln aufzuführen; dass Deutsch dazugehört, ist damit nicht belegt. Ein Test an eigenen Unterlagen schafft Klarheit.

Unter welcher Lizenz steht Qwen3 32B?

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Lässt sich der Denkmodus von Qwen3 32B abschalten?

Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
Qwen3 32BQwen (Alibaba)32,8B128KApache-2.00,12 $
Qwen3.6 35B A3BQwen (Alibaba)35B / 3B256KApache-2.00,15 $
Qwen3 Next 80B A3B InstructQwen (Alibaba)80B / 3B256KApache-2.00,14 $
Qwen3 Coder NextQwen (Alibaba)80B / 3B256KApache-2.00,19 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: