Gemma-4-26B-A4B Uncensored (NVFP4)
Gemma-4-26B-A4B Uncensored ist eine Community-Fassung von Googles Gemma 4 26B A4B (TrevorJS, Apache 2.0), bei der das Ablehnungsverhalten per Abliteration im dichten Pfad und in allen Experten entfernt wurde — ohne neue Trainingsdaten. Die Modellkarte zeigt, dass die Ablehnungen im Haupttest von 98 auf etwa 1 je 100 Anfragen sinken; der Erhalt der Fähigkeiten ist nur indirekt belegt, ein Vergleich mit dem Original ist daher angebracht. Wir betreiben es auf eigener Hardware im EWR; Anfragen und Antworten werden nicht gespeichert.
Modell-ID: gemma4-26b-unc
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="gemma4-26b-unc", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gemma4-26b-unc", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "gemma4-26b-unc", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- TrevorJS
- Veröffentlicht
- April 2026
- Lizenz
- Apache-2.0
- Architektur
- Mixture of Experts · 25,2 Mrd. Parameter, 3,8 Mrd. aktiv je Token
- Basiert auf
- Gemma 4 26B A4B
- Vom Entwickler genannte Sprachen
- Englisch
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Gemma 4 31B oder 26B A4B?
Beide stammen von Google DeepMind, stehen unter Apache 2.0, lesen neben Text auch Bilder, unterstützen über 35 Sprachen, und der Denkmodus ist standardmäßig ausgeschaltet.
Gemma 4 31B ist ein dichtes Modell (Dense, 30,7 Mrd. Parameter) und schneidet laut Modellkarte besser ab: 85,2 % bei MMLU Pro und 80,0 % bei LiveCodeBench v6. Gemma 4 26B A4B ist ein Mixture-of-Experts-Modell mit 3,8 Mrd. aktiven von insgesamt 25,2 Mrd. Parametern, auf Geschwindigkeit ausgelegt, und erreicht 82,6 % bzw. 77,1 %. Gemma-4-26B-A4B Uncensored ist ein Community-Build des 26B-Modells, bei dem das Ablehnungsverhalten entfernt wurde.
Lizenz: was sie für Ihr Unternehmen bedeutet
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Technische Angaben
- Kontextfenster
- 256K Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 4M Tok/min
- Tokenizer
- Gemma
- Streaming
- ja
- Offene Gewichte
- TrevorJS/gemma-4-26B-A4B-it-uncensored
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell läuft auf GPUs, die wir im Europäischen Wirtschaftsraum betreiben. Anfragen und Antworten werden weder protokolliert noch dauerhaft gespeichert, und nichts davon wird für das Training verwendet. Alle Messwerte auf der Infrastrukturseite stammen von diesem Modell: rund 176 Token pro Sekunde je Datenstrom, das erste Token in unter einer Sekunde, 91 bis 97 Prozent Trefferquote im Präfix-Cache bei agentischen Workloads.
Fragen zu diesem Modell
›Wo wird Gemma-4-26B-A4B Uncensored berechnet?
Im Europäischen Wirtschaftsraum, auf Karten, die wir selbst betreiben. Der Katalog nennt die Verarbeitungsregion je Modell — Sie können einer Aufsichtsbehörde antworten, ohne uns zu fragen.
›Speichert Gemma-4-26B-A4B Uncensored Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Gemma-4-26B-A4B Uncensored?
256K Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet Gemma-4-26B-A4B Uncensored?
0,12 $ je Million Token Eingabe und 0,38 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Gemma-4-26B-A4B Uncensored eine Durchsatzgrenze?
Ja, 4M Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Gemma-4-26B-A4B Uncensored Deutsch?
Deutsch steht nicht auf der Liste des Entwicklers (Englisch). Prüfen Sie das Modell mit eigenen deutschsprachigen Unterlagen, bevor Sie sich darauf verlassen.
›Unter welcher Lizenz steht Gemma-4-26B-A4B Uncensored?
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Gemma-4-26B-A4B Uncensored (NVFP4) | TrevorJS | 25,2B / 3,8B | 256K | Apache-2.0 | 0,12 $ |
| Qwen3.8 27B (NVFP4) | Qwen (Alibaba) | 27B | 256K | Apache-2.0 | 0,40 $ |
| Qwen3.8 27B Uncensored (NVFP4) | OrcaRouter | 27B | 512K | Apache-2.0 | 0,20 $ |
| Gemma 4 26B A4B | Google DeepMind | 25,2B / 3,8B | 256K | Apache-2.0 | 0,07 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: