Qwen3.8 27B Uncensored (NVFP4)
Qwen3.8 27B Uncensored ist Qwen3.8 27B, aus dessen Gewichten die Ablehnungsrichtung entfernt wurde (Abliteration nach Arditi et al., veröffentlicht von OrcaRouter unter Apache 2.0); Bildeingabe, Werkzeugaufrufe und Denkmodus bleiben erhalten. Laut Herausgeber dient es der Forschung zu Ablehnungsmechanismen, dem Red-Teaming und der Sicherheitsbewertung; alles, was Endnutzer sehen, braucht eine eigene Moderationsschicht — das Modell kommt auch Anfragen nach, die das Original ablehnt. Wir betreiben es auf eigener Hardware im EWR; Anfragen und Antworten werden nicht gespeichert.
Modell-ID: qwen38-unc
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="qwen38-unc", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen38-unc", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "qwen38-unc", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- OrcaRouter
- Veröffentlicht
- August 2026
- Lizenz
- Apache-2.0
- Architektur
- dicht · 27 Mrd. Parameter
- Basiert auf
- Qwen3.8 27B
- Eingabe
- Text, Bilder
- Denkmodus
- je Anfrage schaltbar
- Vom Entwickler genannte Sprachen
- Englisch, Chinesisch
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Welche Variante von Qwen3.8 27B ist das?
Qwen3.8 27B ist das Originalmodell des Qwen-Teams — die Variante für den Produktivbetrieb. Es ist nicht zu verwechseln mit Qwen3.8-Max, einem eigenständigen und weit größeren Modell, auf das sich die meisten Meldungen zu „Qwen 3.8“ beziehen.
Bei Qwen3.8 27B Uncensored (OrcaRouter) ist die „Ablehnungsrichtung“ aus den Gewichten entfernt; Bildeingabe, Werkzeugaufrufe und Denkmodus bleiben erhalten. Laut Herausgeber sinkt der Anteil abgelehnter schädlicher Anfragen von 64–99 % auf 0–6 %, die Werte bei MMLU, GSM8K und CMMLU weichen um höchstens etwa einen Punkt ab. Qwen3.8 27B Obliterated (OBLITERATUS) entfernt die Ablehnungen mit einem anderen Eingriff in die Gewichte und gibt bei MMLU einen Verlust von rund zwei Punkten an. Beide sind für Forschung und Red-Teaming gedacht.
Qwen3.8 27B Queen ist auf Rollenspiel und Fiktion abgestimmt, Qwen3.8 27B Fable ein leichtes Fine-Tuning auf Dialogen von Assistenten und Code-Agenten. Auf Hugging Face gibt es weitere „uncensored“-Builds desselben Basismodells — welches Repository wir ausliefern, steht unter „Technische Angaben“ im Feld „Offene Gewichte“.
Lizenz: was sie für Ihr Unternehmen bedeutet
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Technische Angaben
- Kontextfenster
- 512K Token
- Maximale Ausgabe
- 32 768 Token
- Durchsatzgrenze
- 32M Tok/min
- Tokenizer
- Qwen
- Streaming
- ja
- Offene Gewichte
- orcarouter/Qwen3.8-27B-Uncensored
- max_tokens
- 1 … 32768
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell läuft auf GPUs, die wir im Europäischen Wirtschaftsraum betreiben. Anfragen und Antworten werden weder protokolliert noch dauerhaft gespeichert, und nichts davon wird für das Training verwendet. Alle Messwerte auf der Infrastrukturseite stammen von diesem Modell: rund 176 Token pro Sekunde je Datenstrom, das erste Token in unter einer Sekunde, 91 bis 97 Prozent Trefferquote im Präfix-Cache bei agentischen Workloads.
Fragen zu diesem Modell
›Wo wird Qwen3.8 27B Uncensored berechnet?
Im Europäischen Wirtschaftsraum, auf Karten, die wir selbst betreiben. Der Katalog nennt die Verarbeitungsregion je Modell — Sie können einer Aufsichtsbehörde antworten, ohne uns zu fragen.
›Speichert Qwen3.8 27B Uncensored Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Qwen3.8 27B Uncensored?
512K Token, davon bis zu 32 768 Token Ausgabe.
›Was kostet Qwen3.8 27B Uncensored?
0,20 $ je Million Token Eingabe und 1,20 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Qwen3.8 27B Uncensored eine Durchsatzgrenze?
Ja, 32M Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Qwen3.8 27B Uncensored Deutsch?
Deutsch steht nicht auf der Liste des Entwicklers (Englisch, Chinesisch). Prüfen Sie das Modell mit eigenen deutschsprachigen Unterlagen, bevor Sie sich darauf verlassen.
›Unter welcher Lizenz steht Qwen3.8 27B Uncensored?
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
›Lässt sich der Denkmodus von Qwen3.8 27B Uncensored abschalten?
Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Qwen3.8 27B Uncensored (NVFP4) | OrcaRouter | 27B | 512K | Apache-2.0 | 0,20 $ |
| Qwen3.8 27B (NVFP4) | Qwen (Alibaba) | 27B | 256K | Apache-2.0 | 0,40 $ |
| Qwen3 32B | Qwen (Alibaba) | 32,8B | 128K | Apache-2.0 | 0,12 $ |
| Qwen3.6 35B A3B | Qwen (Alibaba) | 35B / 3B | 256K | Apache-2.0 | 0,15 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: