Gemma 4 31B
Gemma 4 31B ist das größte Modell der Gemma-4-Reihe von Google DeepMind (Apache 2.0), ein dichtes Netz mit 30,7 Mrd. Parametern. Gebaut ist es für Schlussfolgern, Programmieren und agentische Abläufe mit Funktionsaufrufen sowie für das Verstehen von Dokumenten und Bildern; die Modellkarte nennt 85,2 Prozent bei MMLU Pro. Google gibt Unterstützung für über 35 Sprachen an; der Denkmodus wird je Anfrage zugeschaltet. Bereitgestellt wird es über globale Anbieter im Rahmen unseres europäischen Vertrags; Anfragen gehen nur an Betreiber, die weder Eingaben noch Antworten speichern.
Modell-ID: gemma-4-31b-it
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="gemma-4-31b-it", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gemma-4-31b-it", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "gemma-4-31b-it", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Preisliste, Stand 12. September 2026. Keine Mindestabnahme, kein Abonnement.
Eckdaten
- Entwickler
- Google DeepMind
- Lizenz
- Apache-2.0
- Architektur
- dicht · 30,7 Mrd. Parameter
- Eingabe
- Text, Bilder
- Denkmodus
- je Anfrage schaltbar
- Wissensstand
- Jänner 2025
- Vom Entwickler genannte Sprachen
- 35+ Sprachen
Quelle: Modellkarte des Entwicklers, Stand 17. September 2026.
Gemma 4 31B oder 26B A4B?
Beide stammen von Google DeepMind, stehen unter Apache 2.0, lesen neben Text auch Bilder, unterstützen über 35 Sprachen, und der Denkmodus ist standardmäßig ausgeschaltet.
Gemma 4 31B ist ein dichtes Modell (Dense, 30,7 Mrd. Parameter) und schneidet laut Modellkarte besser ab: 85,2 % bei MMLU Pro und 80,0 % bei LiveCodeBench v6. Gemma 4 26B A4B ist ein Mixture-of-Experts-Modell mit 3,8 Mrd. aktiven von insgesamt 25,2 Mrd. Parametern, auf Geschwindigkeit ausgelegt, und erreicht 82,6 % bzw. 77,1 %. Gemma-4-26B-A4B Uncensored ist ein Community-Build des 26B-Modells, bei dem das Ablehnungsverhalten entfernt wurde.
Lizenz: was sie für Ihr Unternehmen bedeutet
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
Zusammenfassung der Lizenz, keine Rechtsberatung.
Benchmark-Ergebnisse laut Entwickler
- MMLU Pro
- 85,2 %
- GPQA Diamond
- 84,3 %
- MMMLU
- 88,4 %
- LiveCodeBench v6
- 80 %
Werte aus der Modellkarte des Entwicklers, keine eigene Messung. Quelle: huggingface.co/google/gemma-4-31B-it
Technische Angaben
- Kontextfenster
- 256K Token
- Maximale Ausgabe
- 65 536 Token
- Durchsatzgrenze
- 200K Tok/min
- Tokenizer
- Other
- Streaming
- ja
- Offene Gewichte
- google/gemma-4-31b-it
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Dieses Modell wird über globale Anbieter im Rahmen unseres europäischen Vertrags bereitgestellt: ein Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft, eine Rechnung für alle Modelle im Katalog, kein US-Vertragspartner in Ihren Unterlagen. Die Verarbeitung kann außerhalb des EWR erfolgen — ist eine Verarbeitung ausschließlich im EWR gefordert, nutzen Sie unser Modell auf eigener Hardware.
Fragen zu diesem Modell
›Wo wird Gemma 4 31B berechnet?
Außerhalb des EWR, über einen globalen Anbieter unter unserem europäischen Vertrag. Sie haben einen Auftragsverarbeitungsvertrag mit einer EU-Gesellschaft und eine Rechnung, aber die Berechnung läuft nicht im EWR — wir sagen das, statt es zu verschweigen.
›Speichert Gemma 4 31B Anfragen und Antworten?
Nein. Dieses Modell läuft ohne Datenspeicherung: Inhalte werden nicht dauerhaft abgelegt und nichts davon wird für Training verwendet.
›Wie groß ist das Kontextfenster von Gemma 4 31B?
256K Token, davon bis zu 65 536 Token Ausgabe.
›Was kostet Gemma 4 31B?
0,14 $ je Million Token Eingabe und 0,52 $ je Million Token Ausgabe. Keine Mindestabnahme, kein Abonnement; dieselbe Preisliste gilt für die Schnittstelle und für die Rechnung.
›Gibt es bei Gemma 4 31B eine Durchsatzgrenze?
Ja, 200K Token pro Minute. Höhere Grenzen sind eine Frage des Volumens, nicht des Prinzips.
›Versteht Gemma 4 31B Deutsch?
Der Entwickler nennt über 35 Sprachen, ohne sie einzeln aufzuführen; dass Deutsch dazugehört, ist damit nicht belegt. Ein Test an eigenen Unterlagen schafft Klarheit.
›Unter welcher Lizenz steht Gemma 4 31B?
Apache-2.0. Eine freizügige Open-Source-Lizenz: Nutzung, Veränderung und gewerblicher Einsatz sind erlaubt, auch in Produkten, die Sie verkaufen; wer die Gewichte weitergibt, muss Lizenztext und Urheberrechtshinweise mitliefern.
›Lässt sich der Denkmodus von Gemma 4 31B abschalten?
Ja. Laut Entwickler lässt sich der Denkmodus je Anfrage ein- oder ausschalten.
Vergleich mit ähnlichen Modellen
| Modell | Entwickler | Parameter | Kontext | Lizenz | Eingabe / 1 Mio. Token |
|---|---|---|---|---|---|
| Gemma 4 31B | Google DeepMind | 30,7B | 256K | Apache-2.0 | 0,14 $ |
| Gemma 4 26B A4B | Google DeepMind | 25,2B / 3,8B | 256K | Apache-2.0 | 0,07 $ |
| GLM-4.7-Flash | Z.ai | 30B / 3B | 195K | MIT | 0,09 $ |
| Nemotron 3.5 Lightning | NVIDIA | 30B / 3B | 256K | OpenMDW-1.1 | 0,12 $ |
30 weitere Modelle über denselben Schlüssel und dieselbe Rechnung.
Katalog ansehenZuletzt aktualisiert: