Katalóg
Googlesprostredkované

Gemma 4 31B

Gemma 4 31B je najväčší model radu Gemma 4 od Google DeepMind (Apache 2.0), hustá (dense) sieť s 30,7 miliardy parametrov. Je stavaný na uvažovanie, programovanie a agentové pracovné postupy s volaním funkcií, ako aj na porozumenie dokumentom a obrázkom; karta modelu uvádza 85,2 % v teste MMLU Pro. Google deklaruje podporu viac než 35 jazykov a režim uvažovania sa zapína pre každú požiadavku zvlášť. Poskytujeme ho prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy; požiadavky idú len k poskytovateľom, ktorí neuchovávajú vstupy ani odpovede.

ID modelu: gemma-4-31b-it

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="gemma-4-31b-it",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
256K tokenov
Prevádzka
Globálni poskytovatelia · zmluva v EÚ
Volanie nástrojov
Uvažovanie
Štruktúrovaný výstup
Obrazový vstup
Vstup
0,14 $/ 1M
Vstup z cache
0,19 $/ 1M
Výstup
0,52 $/ 1M

Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.

O modeli

Vývojár
Google DeepMind
Licencia
Apache-2.0
Architektúra
hustá (dense) · 30,7 mld. parametrov
Vstup
text, obrázky
Uvažovanie
prepína sa pre každú požiadavku
Aktuálnosť znalostí
január 2025
Jazyky, ktoré uvádza vývojár
35+ jazykov

Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.

Gemma 4 31B, alebo 26B A4B?

Oba pochádzajú od Google DeepMind, vydané pod licenciou Apache 2.0, okrem textu čítajú aj obrázky, podporujú viac než 35 jazykov a uvažovanie majú vypnuté, kým ho nezapnete.

Gemma 4 31B je hustý (dense) model (30,7 miliardy parametrov) a podľa karty dosahuje lepšie výsledky: 85,2 % v MMLU Pro a 80,0 % v LiveCodeBench v6. Gemma 4 26B A4B je model typu mixture of experts s 3,8 miliardy aktívnych z 25,2 miliardy parametrov, navrhnutý na rýchlosť; dosahuje 82,6 % a 77,1 %. Gemma-4-26B-A4B Uncensored je komunitná verzia modelu 26B, ktorá neodmieta požiadavky.

Licencia: čo znamená pre vašu firmu

Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Zhrnutie licencie, nie právne poradenstvo.

Výsledky testov podľa vývojára

MMLU Pro
85,2 %
GPQA Diamond
84,3 %
MMMLU
88,4 %
LiveCodeBench v6
80 %

Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: huggingface.co/google/gemma-4-31B-it

Technické údaje

Kontextové okno
256K tokenov
Maximálny výstup
65 536 tokenov
Limit priepustnosti
200K tok/min
Tokenizer
Other
Streamovanie
áno
Otvorené váhy
google/gemma-4-31b-it
Podporované parametre
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Nakúpené pre vás, fakturované nami

Tento model poskytujeme prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy: jedna zmluva o spracúvaní osobných údajov so spoločnosťou z EÚ, jedna faktúra za všetky modely, žiadny americký zmluvný partner vo vašich dokladoch. Výpočet môže bežať mimo EHP – kde sa vyžaduje spracovanie výlučne v EHP, je na mieste model na našom hardvéri.

Otázky k tomuto modelu

Kde beží Gemma 4 31B?

Mimo EHP, cez globálneho poskytovateľa na základe našej európskej zmluvy. Máte jednu zmluvu o spracúvaní osobných údajov so spoločnosťou z EÚ a jednu faktúru, no samotný výpočet nebeží v EHP – hovoríme to otvorene, nezamlčiavame to.

Ukladá Gemma 4 31B požiadavky a odpovede?

Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.

Aké veľké je kontextové okno modelu Gemma 4 31B?

256K tokenov, z toho najviac 65 536 tokenov na výstupe.

Koľko stojí Gemma 4 31B?

0,14 $ za milión vstupných tokenov a 0,52 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.

Má Gemma 4 31B limit priepustnosti?

Áno, 200K tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.

Rozumie Gemma 4 31B po slovensky?

Vývojár uvádza viac než 35 jazykov bez toho, aby ich vymenoval, takže podpora slovenčiny nie je doložená. Istotu prinesie test na vlastných podkladoch.

Pod akou licenciou vyšiel model Gemma 4 31B?

Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Dá sa pri modeli Gemma 4 31B vypnúť uvažovanie?

Áno. Podľa vývojára sa uvažovanie dá zapnúť alebo vypnúť pri každej požiadavke.

Porovnanie s podobnými modelmi

ModelVývojárParametreKontextLicenciaVstup / 1 mil.
Gemma 4 31BGoogle DeepMind30,7B256KApache-2.00,14 $
Gemma 4 26B A4BGoogle DeepMind25,2B / 3,8B256KApache-2.00,07 $
GLM-4.7-FlashZ.ai30B / 3B195KMIT0,09 $
Nemotron 3.5 LightningNVIDIA30B / 3B256KOpenMDW-1.10,12 $

30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.

Pozrieť si katalóg

Naposledy aktualizované: