GLM-5.3-Flash Uncensored (NVFP4)
GLM-5.3-Flash Uncensored ist ein Community-Build von GLM-5.3-Flash (dealignai, MIT-Lizenz), bei dem das Ablehnungsverhalten durch einen dauerhaften Eingriff in die Gewichte entfernt wurde — ohne Nachtraining und ohne Prompt-Tricks; die Bildeingabe bleibt erhalten. Veröffentlicht wurde es für Alignment- und Sicherheitsforschung; die Modellkarte meldet keinerlei Ablehnungen in einem gängigen Test mit schädlichen Anfragen. Jede Anwendung mit Nutzerkontakt braucht daher eine eigene Moderation. Das Modell ist derzeit nicht in Betrieb; diese Seite bleibt zur Information bestehen.
Modell-ID: glm53-flash-unc
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="glm53-flash-unc", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "glm53-flash-unc", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "glm53-flash-unc", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- dealignai
- Veröffentlicht
- August 2026
- Lizenz
- MIT
- Architektur
- Mixture of Experts · 320 Mrd. Parameter, 18 Mrd. aktiv je Token
- Basiert auf
- GLM-5.3-Flash
- Eingabe
- Text, Bilder
- Denkmodus
- je Anfrage schaltbar
- Vom Entwickler genannte Sprachen
- Englisch
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Lizenz: was sie für Ihr Unternehmen bedeutet
MIT. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Technische Angaben
- Kontextfenster
- 1M Token
- Maximale Ausgabe
- 32 768 Token
- Durchsatzgrenze
- 1,3M Tok/min
- Tokenizer
- Other
- Streaming
- ja
- Offene Gewichte
- dealignai/GLM-5.3-Flash-UNCENSORED-NVFP4
- max_tokens
- 1 … 32768
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird GLM-5.3-Flash Uncensored berechnet?
Im Europäischen Wirtschaftsraum, auf Karten, die wir selbst betreiben. Der Katalog nennt die Verarbeitungsregion je Modell — Sie können einer Aufsichtsbehörde antworten, ohne uns zu fragen.
›Speichert GLM-5.3-Flash Uncensored Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von GLM-5.3-Flash Uncensored?
1M Token, davon bis zu 32 768 Token Ausgabe.
›Was kostet GLM-5.3-Flash Uncensored?
Dieses Modell rechnen wir auf Anfrage ab — schreiben Sie uns, wir kalkulieren es für Ihr Volumen.
›Gibt es bei GLM-5.3-Flash Uncensored eine Durchsatzgrenze?
Ja, 1,3M Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht GLM-5.3-Flash Uncensored Deutsch?
Deutsch steht nicht auf der Liste des Entwicklers (Englisch). Prüfen Sie das Modell mit eigenen deutschsprachigen Unterlagen, bevor Sie sich darauf verlassen.
›Unter welcher Lizenz steht GLM-5.3-Flash Uncensored?
MIT. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
›Lässt sich der Denkmodus von GLM-5.3-Flash Uncensored abschalten?
Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| GLM-5.3-Flash Uncensored (NVFP4) | dealignai | 320B / 18B | 1M | MIT | auf Anfrage |
| GLM-5.3-Flash (NVFP4) | Z.ai | 320B / 18B | 1M | MIT | 0,04 $ |
| GLM-4.7-Flash | Z.ai | 30B / 3B | 195K | MIT | 0,09 $ |
| Qwen3.8 27B (NVFP4) | Qwen (Alibaba) | 27B | 256K | Apache-2.0 | 0,40 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: