Katalog
Googleweitergereicht

Gemma 4 31B

Gemma 4 31B ist das größte Modell der Gemma-4-Reihe von Google DeepMind (Apache 2.0), ein dichtes Netz mit 30,7 Mrd. Parametern. Gebaut ist es für Schlussfolgern, Programmieren und agentische Abläufe mit Funktionsaufrufen sowie für das Verstehen von Dokumenten und Bildern; die Modellkarte nennt 85,2 Prozent bei MMLU Pro. Google gibt Unterstützung für über 35 Sprachen an; der Denkmodus wird je Anfrage zugeschaltet. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.

Modell-ID: gemma-4-31b-it

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="gemma-4-31b-it",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
256K Token
Betrieb
Globale Anbieter · EU-Vertrag
Werkzeugaufrufe
Schlussfolgern
Strukturierte Ausgabe
Bildverstehen
Eingabe
0,14 $/ 1M
Eingabe aus Cache
0,19 $/ 1M
Ausgabe
0,52 $/ 1M

Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.

Eckdaten

Entwickler
Google DeepMind
Lizenz
Apache-2.0
Architektur
dicht · 30,7 Mrd. Parameter
Eingabe
Text, Bilder
Denkmodus
je Anfrage schaltbar
Wissensstand
Jänner 2025
Vom Entwickler genannte Sprachen
35+ Sprachen

Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.

Gemma 4 31B oder 26B A4B?

Beide stammen von Google DeepMind, stehen unter Apache 2.0, lesen neben Text auch Bilder, unterstützen über 35 Sprachen, und der Denkmodus ist standardmäßig ausgeschaltet.

Gemma 4 31B ist ein dichtes Modell (Dense, 30,7 Mrd. Parameter) und schneidet laut Modellkarte besser ab: 85,2 % bei MMLU Pro und 80,0 % bei LiveCodeBench v6. Gemma 4 26B A4B ist ein Mixture-of-Experts-Modell mit 3,8 Mrd. aktiven von insgesamt 25,2 Mrd. Parametern, auf Geschwindigkeit ausgelegt, und erreicht 82,6 % bzw. 77,1 %. Gemma-4-26B-A4B Uncensored ist ein Community-Build des 26B-Modells, bei dem das Ablehnungsverhalten entfernt wurde.

Lizenz: was sie für Ihr Unternehmen bedeutet

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Zusammenfassung der Lizenz, keine Rechtsberatung.

Benchmark-Ergebnisse laut Entwickler

MMLU Pro
85,2 %
GPQA Diamond
84,3 %
MMMLU
88,4 %
LiveCodeBench v6
80 %

Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/google/gemma-4-31B-it

Technische Angaben

Kontextfenster
256K Token
Maximale Ausgabe
65 536 Token
Durchsatzgrenze
200K Tok/min
Tokenizer
Other
Streaming
ja
Offene Gewichte
google/gemma-4-31b-it
Unterstützte Parameter
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Für Sie eingekauft, von uns abgerechnet

Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.

Fragen zu diesem Modell

Wo wird Gemma 4 31B berechnet?

Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.

Speichert Gemma 4 31B Anfragen und Antworten?

Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.

Wie groß ist das Kontextfenster von Gemma 4 31B?

256K Token, davon bis zu 65 536 Token Ausgabe.

Was kostet Gemma 4 31B?

0,14 $ je Million Token Eingabe und 0,52 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.

Gibt es bei Gemma 4 31B eine Durchsatzgrenze?

Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.

Versteht Gemma 4 31B Deutsch?

Der Entwickler nennt über 35 Sprachen, ohne sie einzeln aufzuführen; dass Deutsch dazugehört, ist damit nicht belegt. Ein Test an eigenen Unterlagen schafft Klarheit.

Unter welcher Lizenz steht Gemma 4 31B?

Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.

Lässt sich der Denkmodus von Gemma 4 31B abschalten?

Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.

Vergleich mit ähnlichen Modellen

ModellEntwicklerParameterKontextLizenzEingabe / 1 Mio. Token
Gemma 4 31BGoogle DeepMind30,7B256KApache-2.00,14 $
Gemma 4 26B A4BGoogle DeepMind25,2B / 3,8B256KApache-2.00,07 $
GLM-4.7-FlashZ.ai30B / 3B195KMIT0,09 $
Nemotron 3.5 LightningNVIDIA30B / 3B256KOpenMDW-1.10,12 $

30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.

Katalog ansehen

Zuletzt aktualisiert: