Gemma 4 31B
Gemma 4 31B je najväčší model radu Gemma 4 od Google DeepMind (Apache 2.0), hustá (dense) sieť s 30,7 miliardy parametrov. Je stavaný na uvažovanie, programovanie a agentové pracovné postupy s volaním funkcií, ako aj na porozumenie dokumentom a obrázkom; karta modelu uvádza 85,2 % v teste MMLU Pro. Google deklaruje podporu viac než 35 jazykov a režim uvažovania sa zapína pre každú požiadavku zvlášť. Poskytujeme ho prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy; požiadavky idú len k poskytovateľom, ktorí neuchovávajú vstupy ani odpovede.
ID modelu: gemma-4-31b-it
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="gemma-4-31b-it", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gemma-4-31b-it", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "gemma-4-31b-it", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.
O modeli
- Vývojár
- Google DeepMind
- Licencia
- Apache-2.0
- Architektúra
- hustá (dense) · 30,7 mld. parametrov
- Vstup
- text, obrázky
- Uvažovanie
- prepína sa pre každú požiadavku
- Aktuálnosť znalostí
- január 2025
- Jazyky, ktoré uvádza vývojár
- 35+ jazykov
Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.
Gemma 4 31B, alebo 26B A4B?
Oba pochádzajú od Google DeepMind, vydané pod licenciou Apache 2.0, okrem textu čítajú aj obrázky, podporujú viac než 35 jazykov a uvažovanie majú vypnuté, kým ho nezapnete.
Gemma 4 31B je hustý (dense) model (30,7 miliardy parametrov) a podľa karty dosahuje lepšie výsledky: 85,2 % v MMLU Pro a 80,0 % v LiveCodeBench v6. Gemma 4 26B A4B je model typu mixture of experts s 3,8 miliardy aktívnych z 25,2 miliardy parametrov, navrhnutý na rýchlosť; dosahuje 82,6 % a 77,1 %. Gemma-4-26B-A4B Uncensored je komunitná verzia modelu 26B, ktorá neodmieta požiadavky.
Licencia: čo znamená pre vašu firmu
Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
Zhrnutie licencie, nie právne poradenstvo.
Výsledky testov podľa vývojára
- MMLU Pro
- 85,2 %
- GPQA Diamond
- 84,3 %
- MMMLU
- 88,4 %
- LiveCodeBench v6
- 80 %
Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: huggingface.co/google/gemma-4-31B-it
Technické údaje
- Kontextové okno
- 256K tokenov
- Maximálny výstup
- 65 536 tokenov
- Limit priepustnosti
- 200K tok/min
- Tokenizer
- Other
- Streamovanie
- áno
- Otvorené váhy
- google/gemma-4-31b-it
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Tento model poskytujeme prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy: jedna zmluva o spracúvaní osobných údajov so spoločnosťou z EÚ, jedna faktúra za všetky modely, žiadny americký zmluvný partner vo vašich dokladoch. Výpočet môže bežať mimo EHP – kde sa vyžaduje spracovanie výlučne v EHP, je na mieste model na našom hardvéri.
Otázky k tomuto modelu
›Kde beží Gemma 4 31B?
Mimo EHP, cez globálneho poskytovateľa na základe našej európskej zmluvy. Máte jednu zmluvu o spracúvaní osobných údajov so spoločnosťou z EÚ a jednu faktúru, no samotný výpočet nebeží v EHP – hovoríme to otvorene, nezamlčiavame to.
›Ukladá Gemma 4 31B požiadavky a odpovede?
Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.
›Aké veľké je kontextové okno modelu Gemma 4 31B?
256K tokenov, z toho najviac 65 536 tokenov na výstupe.
›Koľko stojí Gemma 4 31B?
0,14 $ za milión vstupných tokenov a 0,52 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.
›Má Gemma 4 31B limit priepustnosti?
Áno, 200K tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.
›Rozumie Gemma 4 31B po slovensky?
Vývojár uvádza viac než 35 jazykov bez toho, aby ich vymenoval, takže podpora slovenčiny nie je doložená. Istotu prinesie test na vlastných podkladoch.
›Pod akou licenciou vyšiel model Gemma 4 31B?
Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
›Dá sa pri modeli Gemma 4 31B vypnúť uvažovanie?
Áno. Podľa vývojára sa uvažovanie dá zapnúť alebo vypnúť pri každej požiadavke.
Porovnanie s podobnými modelmi
| Model | Vývojár | Parametre | Kontext | Licencia | Vstup / 1 mil. |
|---|---|---|---|---|---|
| Gemma 4 31B | Google DeepMind | 30,7B | 256K | Apache-2.0 | 0,14 $ |
| Gemma 4 26B A4B | Google DeepMind | 25,2B / 3,8B | 256K | Apache-2.0 | 0,07 $ |
| GLM-4.7-Flash | Z.ai | 30B / 3B | 195K | MIT | 0,09 $ |
| Nemotron 3.5 Lightning | NVIDIA | 30B / 3B | 256K | OpenMDW-1.1 | 0,12 $ |
30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.
Pozrieť si katalógNaposledy aktualizované: