Katalóg
Z.aisprostredkované

GLM-4.7-Flash

GLM-4.7-Flash je odľahčený variant Z.ai v triede 30 miliárd parametrov (licencia MIT, január 2026): mixture-of-experts s približne 30 miliardami parametrov, z toho 3 miliardy aktívne na token. Mieri na agentové programovanie, plánovanie úloh a prácu s nástrojmi tam, kde cena a latencia znamenajú viac než špičková kvalita, a vo viackrokových úlohách si uchováva priebeh uvažovania. Karta modelu uvádza 59,2 bodu v teste SWE-bench Verified. Poskytujeme ho prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy; požiadavky idú len k poskytovateľom, ktorí neuchovávajú vstupy ani odpovede.

ID modelu: glm-4.7-flash

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="glm-4.7-flash",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
195K tokenov
Prevádzka
Globálni poskytovatelia · zmluva v EÚ
Volanie nástrojov
Uvažovanie
Štruktúrovaný výstup
Obrazový vstup
Vstup
0,09 $/ 1M
Vstup z cache
0,09 $/ 1M
Výstup
0,62 $/ 1M

Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.

O modeli

Vývojár
Z.ai
Vydaný
január 2026
Licencia
MIT
Architektúra
mixture of experts · 30 mld. parametrov, 3 mld. aktívnych na token
Vstup
text
Uvažovanie
model s uvažovaním
Jazyky, ktoré uvádza vývojár
angličtina, čínština

Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.

Licencia: čo znamená pre vašu firmu

MIT. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Zhrnutie licencie, nie právne poradenstvo.

Výsledky testov podľa vývojára

SWE-bench Verified
59,2
τ²-Bench
79,5

Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: huggingface.co/zai-org/GLM-4.7-Flash

Technické údaje

Kontextové okno
195K tokenov
Maximálny výstup
65 536 tokenov
Limit priepustnosti
200K tok/min
Tokenizer
Other
Streamovanie
áno
Otvorené váhy
z-ai/glm-4.7-flash
Podporované parametre
max_tokens
1 … 65536
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Nakúpené pre vás, fakturované nami

Tento model poskytujeme prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy: jedna zmluva o spracúvaní osobných údajov so spoločnosťou z EÚ, jedna faktúra za všetky modely, žiadny americký zmluvný partner vo vašich dokladoch. Výpočet môže bežať mimo EHP – kde sa vyžaduje spracovanie výlučne v EHP, je na mieste model na našom hardvéri.

Otázky k tomuto modelu

Kde beží GLM-4.7-Flash?

Mimo EHP, cez globálneho poskytovateľa na základe našej európskej zmluvy. Máte jednu zmluvu o spracúvaní osobných údajov so spoločnosťou z EÚ a jednu faktúru, no samotný výpočet nebeží v EHP – hovoríme to otvorene, nezamlčiavame to.

Ukladá GLM-4.7-Flash požiadavky a odpovede?

Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.

Aké veľké je kontextové okno modelu GLM-4.7-Flash?

195K tokenov, z toho najviac 65 536 tokenov na výstupe.

Koľko stojí GLM-4.7-Flash?

0,09 $ za milión vstupných tokenov a 0,62 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.

Má GLM-4.7-Flash limit priepustnosti?

Áno, 200K tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.

Rozumie GLM-4.7-Flash po slovensky?

Slovenčina v zozname vývojára nie je (angličtina, čínština). Model si pred nasadením overte na vlastných slovenských podkladoch.

Pod akou licenciou vyšiel model GLM-4.7-Flash?

MIT. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Dá sa pri modeli GLM-4.7-Flash vypnúť uvažovanie?

Model GLM-4.7-Flash je navrhnutý ako model s uvažovaním; karta modelu neopisuje spôsob, ako ho vypnúť.

Porovnanie s podobnými modelmi

ModelVývojárParametreKontextLicenciaVstup / 1 mil.
GLM-4.7-FlashZ.ai30B / 3B195KMIT0,09 $
GLM-5.3-Flash (NVFP4)Z.ai320B / 18B1MMIT0,04 $
Nemotron 3.5 LightningNVIDIA30B / 3B256KOpenMDW-1.10,12 $
Gemma 4 31BGoogle DeepMind30,7B256KApache-2.00,14 $

30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.

Pozrieť si katalóg

Naposledy aktualizované: