Katalog
Googleweitergereicht

Gemma 4 26B A4B

Gemma 4 26B A4B ist das schnelle Mixture-of-Experts-Modell der Gemma-Reihe von Google DeepMind (Apache 2.0): 25,2 Mrd. Parameter, davon 3,8 Mrd. aktiv je Token. Es beherrscht Schlussfolgern, Programmieren und agentische Abläufe mit nativen Funktionsaufrufen und liest Dokumente, Scans, Diagramme und Screenshots als Bildeingabe — brauchbar für Belege und Formulare. Google nennt Unterstützung für über 35 Sprachen, ohne sie einzeln aufzuführen; der Denkmodus ist standardmäßig aus und bei Bedarf zuschaltbar. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: gemma-4-26b-a4b-it

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="gemma-4-26b-a4b-it",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
256K Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,07 $/ 1M
Eingabe aus Cache
0,07 $/ 1M
Ausgabe
0,34 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
Google DeepMind
Lizenz
Apache-2.0
Architektur
Mixture of Experts · 25,2 Mrd. Parameter, 3,8 Mrd. aktiv je Token
Eingabe
Text, Bilder
Denkmodus
je Anfrage schaltbar
Wissensstand
Jänner 2025
Vom Entwickler genannte Sprachen
35+ Sprachen

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Gemma 4 31B oder 26B A4B?

Beide stammen von Google DeepMind, stehen unter Apache 2.0, lesen neben Text auch Bilder, unterstützen über 35 Sprachen, und der Denkmodus ist standardmäßig ausgeschaltet.

Gemma 4 31B ist ein dichtes Modell (Dense, 30,7 Mrd. Parameter) und schneidet laut Modellkarte besser ab: 85,2 % bei MMLU Pro und 80,0 % bei LiveCodeBench v6. Gemma 4 26B A4B ist ein Mixture-of-Experts-Modell mit 3,8 Mrd. aktiven von insgesamt 25,2 Mrd. Parametern, auf Geschwindigkeit ausgelegt, und erreicht 82,6 % bzw. 77,1 %. Gemma-4-26B-A4B Uncensored ist ein Community-Build des 26B-Modells, bei dem das Ablehnungsverhalten entfernt wurde.

Lizenz: was sie für Ihr Unternehmen bedeutet

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Benchmark-Ergebnisse laut Entwickler

MMLU Pro
82,6 %
GPQA Diamond
82,3 %
MMMLU
86,3 %
LiveCodeBench v6
77,1 %

Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/google/gemma-4-26B-A4B-it

Technische Angaben

Kontextfenster
256K Token
Maximale Ausgabe
65 536 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
Other
Streaming
ja
Offene Gewichte
google/gemma-4-26b-a4b-it
Unterstützte Parameter
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird Gemma 4 26B A4B berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert Gemma 4 26B A4B Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von Gemma 4 26B A4B?

256K Token, davon bis zu 65 536 Token Ausgabe.

Was kostet Gemma 4 26B A4B?

0,07 $ je Million Token Eingabe und 0,34 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei Gemma 4 26B A4B eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht Gemma 4 26B A4B Deutsch?

Der Entwickler nennt über 35 Sprachen, ohne sie einzeln aufzuführen; dass Deutsch dazugehört, ist damit nicht belegt. Ein Test an eigenen Unterlagen schafft Klarheit.

Unter welcher Lizenz steht Gemma 4 26B A4B?

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Lässt sich der Denkmodus von Gemma 4 26B A4B abschalten?

Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
Gemma 4 26B A4BGoogle DeepMind25,2B / 3,8B256KApache-2.00,07 $
Gemma 4 31BGoogle DeepMind30,7B256KApache-2.00,14 $
Mistral Small 24B (2501)Mistral AI24B32KApache-2.00,05 $
Cydonia 24B v4.1TheDrummer24B128K0,42 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: