Gemma 4 26B A4B
Gemma 4 26B A4B ist das schnelle Mixture-of-Experts-Modell der Gemma-Reihe von Google DeepMind (Apache 2.0): 25,2 Mrd. Parameter, davon 3,8 Mrd. aktiv je Token. Es beherrscht Schlussfolgern, Programmieren und agentische Abläufe mit nativen Funktionsaufrufen und liest Dokumente, Scans, Diagramme und Screenshots als Bildeingabe — brauchbar für Belege und Formulare. Google nennt Unterstützung für über 35 Sprachen, ohne sie einzeln aufzuführen; der Denkmodus ist standardmäßig aus und bei Bedarf zuschaltbar. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.
Modell-ID: gemma-4-26b-a4b-it
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="gemma-4-26b-a4b-it", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gemma-4-26b-a4b-it", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "gemma-4-26b-a4b-it", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- Google DeepMind
- Lizenz
- Apache-2.0
- Architektur
- Mixture of Experts · 25,2 Mrd. Parameter, 3,8 Mrd. aktiv je Token
- Eingabe
- Text, Bilder
- Denkmodus
- je Anfrage schaltbar
- Wissensstand
- Jänner 2025
- Vom Entwickler genannte Sprachen
- 35+ Sprachen
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Gemma 4 31B oder 26B A4B?
Beide stammen von Google DeepMind, stehen unter Apache 2.0, lesen neben Text auch Bilder, unterstützen über 35 Sprachen, und der Denkmodus ist standardmäßig ausgeschaltet.
Gemma 4 31B ist ein dichtes Modell (Dense, 30,7 Mrd. Parameter) und schneidet laut Modellkarte besser ab: 85,2 % bei MMLU Pro und 80,0 % bei LiveCodeBench v6. Gemma 4 26B A4B ist ein Mixture-of-Experts-Modell mit 3,8 Mrd. aktiven von insgesamt 25,2 Mrd. Parametern, auf Geschwindigkeit ausgelegt, und erreicht 82,6 % bzw. 77,1 %. Gemma-4-26B-A4B Uncensored ist ein Community-Build des 26B-Modells, bei dem das Ablehnungsverhalten entfernt wurde.
Lizenz: was sie für Ihr Unternehmen bedeutet
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Benchmark-Ergebnisse laut Entwickler
- MMLU Pro
- 82,6 %
- GPQA Diamond
- 82,3 %
- MMMLU
- 86,3 %
- LiveCodeBench v6
- 77,1 %
Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/google/gemma-4-26B-A4B-it
Technische Angaben
- Kontextfenster
- 256K Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 200K Tok/min
- Tokenizer
- Other
- Streaming
- ja
- Offene Gewichte
- google/gemma-4-26b-a4b-it
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird Gemma 4 26B A4B berechnet?
Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.
›Speichert Gemma 4 26B A4B Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Gemma 4 26B A4B?
256K Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet Gemma 4 26B A4B?
0,07 $ je Million Token Eingabe und 0,34 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Gemma 4 26B A4B eine Durchsatzgrenze?
Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Gemma 4 26B A4B Deutsch?
Der Entwickler nennt über 35 Sprachen, ohne sie einzeln aufzuführen; dass Deutsch dazugehört, ist damit nicht belegt. Ein Test an eigenen Unterlagen schafft Klarheit.
›Unter welcher Lizenz steht Gemma 4 26B A4B?
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
›Lässt sich der Denkmodus von Gemma 4 26B A4B abschalten?
Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Gemma 4 26B A4B | Google DeepMind | 25,2B / 3,8B | 256K | Apache-2.0 | 0,07 $ |
| Gemma 4 31B | Google DeepMind | 30,7B | 256K | Apache-2.0 | 0,14 $ |
| Mistral Small 24B (2501) | Mistral AI | 24B | 32K | Apache-2.0 | 0,05 $ |
| Cydonia 24B v4.1 | TheDrummer | 24B | 128K | — | 0,42 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: