GLM-4.7-Flash
GLM-4.7-Flash je odľahčený variant Z.ai v triede 30 miliárd parametrov (licencia MIT, január 2026): mixture-of-experts s približne 30 miliardami parametrov, z toho 3 miliardy aktívne na token. Mieri na agentové programovanie, plánovanie úloh a prácu s nástrojmi tam, kde cena a latencia znamenajú viac než špičková kvalita, a vo viackrokových úlohách si uchováva priebeh uvažovania. Karta modelu uvádza 59,2 bodu v teste SWE-bench Verified. Poskytujeme ho prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy; požiadavky idú len k poskytovateľom, ktorí neuchovávajú vstupy ani odpovede.
ID modelu: glm-4.7-flash
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="glm-4.7-flash", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "glm-4.7-flash", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "glm-4.7-flash", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.
O modeli
- Vývojár
- Z.ai
- Vydaný
- január 2026
- Licencia
- MIT
- Architektúra
- mixture of experts · 30 mld. parametrov, 3 mld. aktívnych na token
- Vstup
- text
- Uvažovanie
- model s uvažovaním
- Jazyky, ktoré uvádza vývojár
- angličtina, čínština
Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.
Licencia: čo znamená pre vašu firmu
MIT. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
Zhrnutie licencie, nie právne poradenstvo.
Výsledky testov podľa vývojára
- SWE-bench Verified
- 59,2
- τ²-Bench
- 79,5
Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: huggingface.co/zai-org/GLM-4.7-Flash
Technické údaje
- Kontextové okno
- 195K tokenov
- Maximálny výstup
- 65 536 tokenov
- Limit priepustnosti
- 200K tok/min
- Tokenizer
- Other
- Streamovanie
- áno
- Otvorené váhy
- z-ai/glm-4.7-flash
- max_tokens
- 1 … 65536
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Tento model poskytujeme prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy: jedna zmluva o spracúvaní osobných údajov so spoločnosťou z EÚ, jedna faktúra za všetky modely, žiadny americký zmluvný partner vo vašich dokladoch. Výpočet môže bežať mimo EHP – kde sa vyžaduje spracovanie výlučne v EHP, je na mieste model na našom hardvéri.
Otázky k tomuto modelu
›Kde beží GLM-4.7-Flash?
Mimo EHP, cez globálneho poskytovateľa na základe našej európskej zmluvy. Máte jednu zmluvu o spracúvaní osobných údajov so spoločnosťou z EÚ a jednu faktúru, no samotný výpočet nebeží v EHP – hovoríme to otvorene, nezamlčiavame to.
›Ukladá GLM-4.7-Flash požiadavky a odpovede?
Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.
›Aké veľké je kontextové okno modelu GLM-4.7-Flash?
195K tokenov, z toho najviac 65 536 tokenov na výstupe.
›Koľko stojí GLM-4.7-Flash?
0,09 $ za milión vstupných tokenov a 0,62 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.
›Má GLM-4.7-Flash limit priepustnosti?
Áno, 200K tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.
›Rozumie GLM-4.7-Flash po slovensky?
Slovenčina v zozname vývojára nie je (angličtina, čínština). Model si pred nasadením overte na vlastných slovenských podkladoch.
›Pod akou licenciou vyšiel model GLM-4.7-Flash?
MIT. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
›Dá sa pri modeli GLM-4.7-Flash vypnúť uvažovanie?
Model GLM-4.7-Flash je navrhnutý ako model s uvažovaním; karta modelu neopisuje spôsob, ako ho vypnúť.
Porovnanie s podobnými modelmi
| Model | Vývojár | Parametre | Kontext | Licencia | Vstup / 1 mil. |
|---|---|---|---|---|---|
| GLM-4.7-Flash | Z.ai | 30B / 3B | 195K | MIT | 0,09 $ |
| GLM-5.3-Flash (NVFP4) | Z.ai | 320B / 18B | 1M | MIT | 0,04 $ |
| Nemotron 3.5 Lightning | NVIDIA | 30B / 3B | 256K | OpenMDW-1.1 | 0,12 $ |
| Gemma 4 31B | Google DeepMind | 30,7B | 256K | Apache-2.0 | 0,14 $ |
30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.
Pozrieť si katalógNaposledy aktualizované: