Katalog
Qweneigene Hardware · EWR

Qwen3.8 27B Uncensored (NVFP4)

Qwen3.8 27B Uncensored ist Qwen3.8 27B, aus dessen Gewichten die Ablehnungsrichtung entfernt wurde (Abliteration nach Arditi et al., veröffentlicht von OrcaRouter unter Apache 2.0); Bildeingabe, Werkzeugaufrufe und Denkmodus bleiben erhalten. Laut Herausgeber dient es der Forschung zu Ablehnungsmechanismen, dem Red-Teaming und der Sicherheitsbewertung; alles, was Endnutzer sehen, braucht eine eigene Moderationsschicht — das Modell kommt auch Anfragen nach, die das Original ablehnt. Wir betreiben es auf eigener Hardware im EWR; Anfragen und Antworten werden nicht gespeichert.

Modell-ID: qwen38-unc

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="qwen38-unc",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
512K Token
Betrieb
Eigene Hardware · EWR
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,20 $/ 1M
Eingabe aus Cache
0,25 $/ 1M
Ausgabe
1,20 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
OrcaRouter
Veröffentlicht
August 2026
Lizenz
Apache-2.0
Architektur
dicht · 27 Mrd. Parameter
Basiert auf
Qwen3.8 27B
Eingabe
Text, Bilder
Denkmodus
je Anfrage schaltbar
Vom Entwickler genannte Sprachen
Englisch, Chinesisch

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Welche Variante von Qwen3.8 27B ist das?

Qwen3.8 27B ist das Originalmodell des Qwen-Teams — die Variante für den Produktivbetrieb. Es ist nicht zu verwechseln mit Qwen3.8-Max, einem eigenständigen und weit größeren Modell, auf das sich die meisten Meldungen zu „Qwen 3.8“ beziehen.

Bei Qwen3.8 27B Uncensored (OrcaRouter) ist die „Ablehnungsrichtung“ aus den Gewichten entfernt; Bildeingabe, Werkzeugaufrufe und Denkmodus bleiben erhalten. Laut Herausgeber sinkt der Anteil abgelehnter schädlicher Anfragen von 64–99 % auf 0–6 %, die Werte bei MMLU, GSM8K und CMMLU weichen um höchstens etwa einen Punkt ab. Qwen3.8 27B Obliterated (OBLITERATUS) entfernt die Ablehnungen mit einem anderen Eingriff in die Gewichte und gibt bei MMLU einen Verlust von rund zwei Punkten an. Beide sind für Forschung und Red-Teaming gedacht.

Qwen3.8 27B Queen ist auf Rollenspiel und Fiktion abgestimmt, Qwen3.8 27B Fable ein leichtes Fine-Tuning auf Dialogen von Assistenten und Code-Agenten. Auf Hugging Face gibt es weitere „uncensored“-Builds desselben Basismodells — welches Repository wir ausliefern, steht unter „Technische Angaben“ im Feld „Offene Gewichte“.

Lizenz: was sie für Ihr Unternehmen bedeutet

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Technische Angaben

Kontextfenster
512K Token
Maximale Ausgabe
32 768 Token
Durchsatzgrenze
32M Tok/min
Tokenizer
Qwen
Streaming
ja
Offene Gewichte
orcarouter/Qwen3.8-27B-Uncensored
Unterstützte Parameter
max_tokens
1 … 32768
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Verarbeitung im EWR, keine Protokolle

Dieses Modell läuft auf GPUs, die wir im Europäischen Wirtschaftsraum betreiben. Anfragen und Antworten werden weder protokolliert noch dauerhaft gespeichert, und nichts davon wird für das Training verwendet. Alle Messwerte auf der Infrastrukturseite stammen von diesem Modell: rund 176 Token pro Sekunde je Datenstrom, das erste Token in unter einer Sekunde, 91 bis 97 Prozent Trefferquote im Präfix-Cache bei agentischen Workloads.

Fragen zu diesem Modell

Wo wird Qwen3.8 27B Uncensored berechnet?

Im Europäischen Wirtschaftsraum, auf Karten, die wir selbst betreiben. Der Katalog nennt die Verarbeitungsregion je Modell — Sie können einer Aufsichtsbehörde antworten, ohne uns zu fragen.

Speichert Qwen3.8 27B Uncensored Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von Qwen3.8 27B Uncensored?

512K Token, davon bis zu 32 768 Token Ausgabe.

Was kostet Qwen3.8 27B Uncensored?

0,20 $ je Million Token Eingabe und 1,20 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei Qwen3.8 27B Uncensored eine Durchsatzgrenze?

Ja, 32M Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht Qwen3.8 27B Uncensored Deutsch?

Deutsch steht nicht auf der Liste des Entwicklers (Englisch, Chinesisch). Prüfen Sie das Modell mit eigenen deutschsprachigen Unterlagen, bevor Sie sich darauf verlassen.

Unter welcher Lizenz steht Qwen3.8 27B Uncensored?

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Lässt sich der Denkmodus von Qwen3.8 27B Uncensored abschalten?

Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
Qwen3.8 27B Uncensored (NVFP4)OrcaRouter27B512KApache-2.00,20 $
Qwen3.8 27B (NVFP4)Qwen (Alibaba)27B256KApache-2.00,40 $
Qwen3 32BQwen (Alibaba)32,8B128KApache-2.00,12 $
Qwen3.6 35B A3BQwen (Alibaba)35B / 3B256KApache-2.00,15 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: