Heabsy · Katalóg modelov

Pri každom modeli platí: jeden kľúč, jedna faktúra, jeden európsky zmluvný partner.

API kompatibilné s OpenAI aj Anthropic. Ceny za milión tokenov priamo z nášho cenníka – bez minimálneho odberu a bez predplatného.

Náš hardvér – spracovanie v EHP

Beží na grafických kartách, ktoré prevádzkujeme v Európskom hospodárskom priestore. Bez uchovávania údajov, s vyrovnávacou pamäťou (cache) prefixov. Každý údaj o rýchlosti na stránke o infraštruktúre sme namerali práve tu. Kto potrebuje spracovanie výlučne v EHP, zostáva na tejto úrovni.

Sprostredkované – nakúpené pre vás, fakturované nami

Poskytované prostredníctvom globálnych poskytovateľov na základe našej európskej zmluvy: podpíšete jednu zmluvu o spracúvaní osobných údajov so spoločnosťou z EÚ a dostanete jednu faktúru za všetky modely namiesto amerického zmluvného partnera pri každom dodávateľovi. Výpočet môže bežať mimo EHP – katalóg to hovorí otvorene, nezamlčiava to.

Všetky modely, jeden kľúč, jedna faktúra

Spracovanie
Úroveň
Schopnosti
Kontext
31 / 31 modelov
ModelSpracovanieKontextVstupCacheVýstupLimitSchopnosti
GLM-5.3-Flash (NVFP4)Z.aimimo EHP1M0,04 $0,02 $0,12 $50MObraz · Uvažovanie · Volanie nástrojov
gpt-oss-20bOpenAImimo EHP128K0,05 $0,12 $0,20 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Mistral Small 24B (2501)Mistralmimo EHP32K0,05 $na požiadanie0,08 $200KŠtruktúrovaný výstup
DeepSeek-V4-Flash-0731DeepSeekmimo EHP1.3M0,06 $0,06 $0,12 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Gemma 4 26B A4BGooglemimo EHP256K0,07 $0,07 $0,34 $200KObraz · Uvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Llama 3.1 8B InstructMetamimo EHP128K0,08 $0,10 $0,12 $200KVolanie nástrojov · Štruktúrovaný výstup
Laguna S 2.1Poolsidemimo EHP1M0,09 $0,01 $0,18 $200KUvažovanie · Volanie nástrojov
Granite 4.2 8BIBMmimo EHP128K0,09 $0,06 $0,39 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
GLM-4.7-FlashZ.aimimo EHP195K0,09 $0,09 $0,62 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
gpt-oss-120bOpenAImimo EHP128K0,11 $na požiadanie0,51 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Gemma-4-26B-A4B Uncensored (NVFP4)TrevorJSiba EHP256K0,12 $0,03 $0,38 $4M
Nemotron 3.5 LightningNVIDIAmimo EHP256K0,12 $0,15 $0,31 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Qwen3 32BQwenmimo EHP128K0,12 $0,12 $0,43 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Nemotron 3 Super 120B A12BNVIDIAmimo EHP256K0,13 $0,13 $0,62 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Qwen3 Next 80B A3B InstructQwenmimo EHP256K0,14 $0,14 $1,70 $200K
Gemma 4 31BGooglemimo EHP256K0,14 $0,19 $0,52 $200KObraz · Uvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Qwen3.8 Flash-NextQwenmimo EHP256K0,15 $0,02 $0,47 $200KObraz · Uvažovanie · Volanie nástrojov
DeepSeek-V4.1-FlashDeepSeekmimo EHP1M0,15 $na požiadanie0,60 $200KObraz · Uvažovanie · Volanie nástrojov
Qwen3.5 9BQwenmimo EHP256K0,15 $0,15 $0,23 $200KObraz · Uvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Llama 3.3 70B InstructMetamimo EHP128K0,15 $0,15 $0,49 $200KVolanie nástrojov · Štruktúrovaný výstup
Qwen3.6 35B A3BQwenmimo EHP256K0,15 $0,19 $1,39 $200K
Qwen3 Coder NextQwenmimo EHP256K0,19 $0,27 $1,23 $200KVolanie nástrojov · Štruktúrovaný výstup
Qwen3.8 27B Uncensored (NVFP4)Qweniba EHP512K0,20 $0,25 $1,20 $32MObraz · Uvažovanie · Volanie nástrojov
DeepSeek V4 FlashDeepSeekmimo EHP1M0,25 $0,02 $0,50 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Qwen3.8 27B (NVFP4)Qweniba EHP256K0,40 $0,05 $3,00 $4MObraz · Uvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Cydonia 24B v4.1TheDrummermimo EHP128K0,42 $0,30 $0,71 $200KŠtruktúrovaný výstup
Skyfall 36B v2TheDrummermimo EHP32K0,71 $0,50 $1,13 $200KŠtruktúrovaný výstup
DeepSeek-V4-Pro-0813DeepSeekmimo EHP1M0,80 $0,15 $2,40 $200KUvažovanie · Volanie nástrojov · Štruktúrovaný výstup
Kimi K3 (FP4)Moonshot AImimo EHP1M2,20 $0,70 $11,00 $200KUvažovanie · Volanie nástrojov
GLM-5.3-Flash Uncensored (NVFP4)nedostupnýZ.aiiba EHP1Mna požiadaniena požiadaniena požiadanie1.3MObraz
K2-Horizon 7B (FP8, reasoning + tools)nedostupnýIFMmimo EHP128Kna požiadaniena požiadaniena požiadanie1.5M

Cenník, stav: 12. septembra 2026. Jeden cenník pre rozhranie aj pre faktúru. Bez minimálneho odberu a bez predplatného; pri modeloch bez uvedenej ceny ju oznámime na požiadanie.api.heabsy.com/openrouter/v1/models

Chýba vám model, ktorý potrebujete?

Sprostredkovaný katalóg rozširujeme na požiadanie a otvorené modely vieme nasadiť na náš hardvér v EHP, keď záťaž opodstatní vyhradenú kapacitu.

Napíšte nám

Ktorý AI model na akú úlohu

Vychádzajte z úlohy, nie z rebríčka. Každá skupina odkazuje na stránky modelov; údaje na nich pochádzajú z kariet modelov, ktoré zverejnili vývojári.

Agenti na programovanie a prácu s nástrojmi

Dlhá viackroková práca v repozitároch a termináli: model plánuje, volá nástroje a zvláda chyby.

Kimi K3 · DeepSeek-V4-Pro-0813 · DeepSeek-V4-Flash-0731 · Qwen3 Coder Next · Laguna S 2.1 · GLM-5.3-Flash

Dokumenty, skeny a snímky obrazovky

Modely, ktoré okrem textu čítajú aj obrázky – faktúry, formuláre, grafy, snímky obrazoviek aplikácií.

Qwen3.8 27B · Gemma 4 31B · Gemma 4 26B A4B · Qwen3.5 9B · DeepSeek-V4.1-Flash

Veľmi dlhý vstup (1 milión tokenov)

Celá kódová báza, rozsiahle zmluvy alebo dlhé spisy v jednej požiadavke.

GLM-5.3-Flash · DeepSeek-V4-Flash-0731 · Laguna S 2.1 · DeepSeek-V4.1-Flash · DeepSeek V4 Flash · DeepSeek-V4-Pro-0813 · Kimi K3

Rýchle a lacné rutinné volania

Klasifikácia, extrakcia polí, smerovanie požiadaviek – tam, kde rozhodujú latencia a cena za jedno volanie.

gpt-oss-20b · Granite 4.2 8B · Mistral Small 24B · Llama 3.1 8B Instruct · Nemotron 3.5 Lightning

Uvažovanie v bežnej prevádzke

Asistenti a úlohy v back office, ktoré potrebujú spoľahlivé uvažovanie za nižšie náklady než pri najväčších modeloch.

gpt-oss-120b · Nemotron 3 Super 120B A12B · Qwen3 32B · Llama 3.3 70B Instruct

Spracúvanie výlučne v EHP

Iba tieto modely bežia na našom hardvéri; požiadavky sa nezaznamenávajú a neopúšťajú EHP.

Qwen3.8 27B · Gemma-4-26B-A4B Uncensored · Qwen3.8 27B Uncensored

Výskum bezpečnosti a red-teaming

Varianty, ktoré neodmietajú požiadavky. Všetko, čo uvidia koncoví používatelia, vyžaduje vlastné moderovanie obsahu.

Qwen3.8 27B Uncensored · Gemma-4-26B-A4B Uncensored

Beletria a hranie rolí

Doladené na tvorivé písanie a zotrvanie v role – nie sú určené pre asistentov v kontakte so zákazníkmi.

Cydonia 24B v4.1 · Skyfall 36B v2

Podporujú AI modely slovenčinu? Čo uvádzajú vývojári

Model môže slovenčinu zvládať, aj keď ju vývojár neuvádza – doložené je však len to, čo je uvedené na karte modelu. Tabuľka ukazuje práve to; kde karta nič neuvádza, istotu prinesie test na vlastných podkladoch.

ModelVývojárSlovenčina podľa vývojáraJazyky na karte modelu
Qwen3.8 27BQwen (Alibaba)karta jazyky neuvádza
Gemma-4-26B-A4B UncensoredTrevorJSneuvedenáangličtina
Qwen3.8 27B UncensoredOrcaRouterneuvedenáangličtina, čínština
GLM-5.3-FlashZ.aineuvedenáangličtina, čínština
gpt-oss-20bOpenAIkarta jazyky neuvádza
Mistral Small 24BMistral AIneuvedenáangličtina, francúzština, nemčina, španielčina, taliančina, portugalčina, holandčina, poľština, ruština, čínština, japončina, kórejčina
DeepSeek-V4-Flash-0731DeepSeekkarta jazyky neuvádza
Gemma 4 26B A4BGoogle DeepMind35+ jazykov, bez zoznamu35+ jazykov, bez zoznamu
Llama 3.1 8B InstructMetaneuvedenáangličtina, nemčina, francúzština, taliančina, portugalčina, hindčina, španielčina, thajčina
Laguna S 2.1Poolsidekarta jazyky neuvádza
Granite 4.2 8BIBMneuvedená (čeština áno)angličtina, nemčina, španielčina, francúzština, japončina, portugalčina, arabčina, čeština, taliančina, kórejčina, holandčina, čínština
GLM-4.7-FlashZ.aineuvedenáangličtina, čínština
gpt-oss-120bOpenAIkarta jazyky neuvádza
Nemotron 3.5 LightningNVIDIAneuvedenáangličtina, španielčina, francúzština, nemčina, taliančina, japončina
Qwen3 32BQwen (Alibaba)100+ jazykov, bez zoznamu100+ jazykov, bez zoznamu
Nemotron 3 Super 120B A12BNVIDIAneuvedenáangličtina, francúzština, nemčina, taliančina, japončina, španielčina, čínština
Qwen3 Next 80B A3B InstructQwen (Alibaba)karta jazyky neuvádza
Gemma 4 31BGoogle DeepMind35+ jazykov, bez zoznamu35+ jazykov, bez zoznamu
Qwen3.8 Flash-NextQwen (Alibaba)karta jazyky neuvádza
DeepSeek-V4.1-FlashDeepSeekkarta jazyky neuvádza
Qwen3.5 9BQwen (Alibaba)201 jazykov, bez zoznamu201 jazykov, bez zoznamu
Llama 3.3 70B InstructMetaneuvedenáangličtina, nemčina, francúzština, taliančina, portugalčina, hindčina, španielčina, thajčina
Qwen3.6 35B A3BQwen (Alibaba)karta jazyky neuvádza
Qwen3 Coder NextQwen (Alibaba)karta jazyky neuvádza
DeepSeek V4 FlashDeepSeekkarta jazyky neuvádza
Cydonia 24B v4.1TheDrummerkarta jazyky neuvádza
Skyfall 36B v2TheDrummerkarta jazyky neuvádza
DeepSeek-V4-Pro-0813DeepSeekkarta jazyky neuvádza
Kimi K3Moonshot AIkarta jazyky neuvádza

Otvorené váhy, open source a licencie

Pojem „otvorené váhy“ znamená, že natrénované parametre modelu sú zverejnené; trénovacie údaje zvyčajne nie. Čo s modelom môžete robiť, určuje jeho licencia – cez naše API rovnako ako na vlastnom serveri.

Apache-2.0, MIT

Permisívna: komerčné použitie a úpravy dovolené; pri ďalšom šírení zachovať text licencie a upozornenia na autorské práva.

Qwen3.8 27B · Gemma-4-26B-A4B Uncensored · Qwen3.8 27B Uncensored · GLM-5.3-Flash · gpt-oss-20b · Mistral Small 24B · DeepSeek-V4-Flash-0731 · Gemma 4 26B A4B · Granite 4.2 8B · GLM-4.7-Flash · gpt-oss-120b · Qwen3 32B · Qwen3 Next 80B A3B Instruct · Gemma 4 31B · DeepSeek-V4.1-Flash · Qwen3.5 9B · Qwen3.6 35B A3B · Qwen3 Coder Next · DeepSeek V4 Flash · DeepSeek-V4-Pro-0813

Llama 3.1 Community License, Llama 3.3 Community License

Komunitná licencia spoločnosti Meta a pravidlá prijateľného používania; komerčné použitie za ich podmienok.

Llama 3.1 8B Instruct · Llama 3.3 70B Instruct

OpenMDW-1.1

Permisívna licencia pre váhy a údaje; komerčné produkty bez osobitného povolenia.

Laguna S 2.1 · Nemotron 3.5 Lightning

NVIDIA Nemotron Open Model License

Vlastná licencia spoločnosti NVIDIA pre otvorené modely; model označený ako pripravený na komerčné použitie.

Nemotron 3 Super 120B A12B

Qwen Community License 1.0

Na poskytovanie modelu ako služby alebo ako AI pracovného asistenta treba osobitnú licenciu; nad určitou veľkosťou produktu je povinné uvádzanie názvu.

Qwen3.8 Flash-Next

Karta modelu licenciu neuvádza – práva na komerčné použitie sú nejasné.

Cydonia 24B v4.1 · Skyfall 36B v2

Kimi K3 License

Na poskytovanie modelu ako služby pri tržbách skupiny nad 20 miliónov USD treba osobitnú dohodu; nad určitou veľkosťou produktu je povinné uvádzanie názvu.

Kimi K3

Lokálny AI model, alebo API?

Cez API nič nesťahujete: model už beží, pošlete požiadavku kompatibilnú s OpenAI API na base_url https://api.heabsy.com/v1 s ID modelu a platíte za tokeny. Zmena modelu znamená zmenu jedného reťazca.

Vlastný server má zmysel pri malom modeli a stabilnej záťaži – podľa OpenAI sa gpt-oss-20b zmestí do 16 GB pamäte. Pri najväčších modeloch katalógu je to inak: Kimi K3 má 2,8 bilióna parametrov, DeepSeek-V4-Pro-0813 1,6 bilióna, čo si vyžaduje infraštruktúru na úrovni dátového centra.

GDPR: vývojár, poskytovateľ a miesto spracúvania – tri rôzne otázky

To, kto model vyvinul, ešte nehovorí nič o tom, kam idú vaše údaje. Rozhoduje, kto ho prevádzkuje a kde prebieha výpočet. Národný bezpečnostný úrad na prelome januára a februára 2025 upozornil na zber údajov v službe a aplikácii DeepSeek; podľa úradu sa mu dá vyhnúť napríklad prácou s lokálnym modelom. Otvorené váhy, ktoré prevádzkujú iní poskytovatelia, sú teda iná situácia.

Pri každom modeli uvádzame miesto spracúvania: v EHP na našom hardvéri alebo mimo EHP u globálnych poskytovateľov na základe našej európskej zmluvy. Pre obe možnosti s vami uzatvárame zmluvu o spracúvaní osobných údajov; vaším zmluvným partnerom je naša spoločnosť so sídlom v EÚ. Požiadavky sa nepoužívajú na trénovanie. Pri spracúvaní mimo EHP posúďte osobitne aj základ prenosu údajov; právny základ, minimalizácia údajov a posúdenie vplyvu na ochranu údajov zostávajú v zodpovednosti vašej firmy.

Pojmy v katalógu

Token
Jednotka textu, ktorú model spracúva na vstupe a výstupe – približne krátke slovo alebo časť slova. Ceny sa uvádzajú za milión tokenov, osobitne za vstup a výstup.
Kontextové okno
Koľko tokenov sa zmestí do jednej požiadavky vrátane doterajšej konverzácie a priložených dokumentov.
Vstup z cache
Vstup, ktorý model už spracoval v predchádzajúcej požiadavke tej istej konverzácie. Účtuje sa lacnejšie a pri práci agentov zvyčajne tvorí najväčšiu časť.
Uvažovanie (thinking)
Model pred odpoveďou vypisuje medzikroky uvažovania. Pomáha to pri náročných úlohách a spotrebúva to výstupné tokeny aj čas.
Mixture of experts, aktívne parametre
Pri každom tokene pracuje iba časť siete. Model s 284 miliardami parametrov a 13 miliardami aktívnych veľkosťou zodpovedá prvému číslu a rýchlosťou približne druhému.
FP8, NVFP4 v názve modelu
Číselná presnosť, s ktorou sa váhy používajú pri prevádzke. Nižšia presnosť vyžaduje menej pamäte; model je ten istý.
LLM (veľký jazykový model)
Model natrénovaný na veľkom množstve textu, ktorý dokáže text spracúvať aj generovať. Všetky modely v tomto katalógu sú LLM; niektoré čítajú aj obrázky.
Halucinácie
Tvrdenia, ktoré znejú presvedčivo, ale nie sú pravdivé. Pri práci s firemnými dokumentmi ich výskyt pomáha znížiť, keď model odpovedá s odkazom na zdroj.

Časté otázky

Ktorý model si vybrať?+

Pri práci s dokumentmi v slovenčine, češtine alebo nemčine o tom rozhodne pilotný test na vašich vlastných podkladoch, nie rebríček: na zmluvách a smerniciach sa modely líšia výraznejšie, než naznačujú testy. Kde sa vyžaduje spracovanie výlučne v EHP, prichádza do úvahy iba model na našom hardvéri.

Aký je rozdiel medzi modelmi na našom hardvéri a sprostredkovanými modelmi?+

Pri modeli na našom hardvéri prevádzkujeme grafické karty sami v Európskom hospodárskom priestore: požiadavky sa nezaznamenávajú, nič sa nepoužíva na trénovanie a spracovanie zostáva v EHP. Sprostredkované modely nakupujeme u globálnych poskytovateľov na základe našej európskej zmluvy – máte jednu zmluvu o spracúvaní osobných údajov a jednu faktúru, no výpočet môže bežať mimo EHP. Katalóg pri každom modeli uvádza, čo preň platí.

Menia sa ceny?+

Áno. Zoznam sa generuje z katalógu našej API brány a aktualizuje sa spolu s ním; cena každého modelu je v našom cenníku a dátum stavu je uvedený pod katalógom. Pri modeloch bez uvedenej ceny ju oznámime na požiadanie.

Je stanovený minimálny odber?+

Nie. Nevyžadujeme minimálny odber, minimálny obrat ani predplatné. Platí sa podľa tokenov, osobitne za nový vstup, vstup z vyrovnávacej pamäte a výstup. Pri agentovej práci tvorí vstup z vyrovnávacej pamäte najväčšiu položku a stojí zlomok ceny nového vstupu.

Dostaneme faktúru od spoločnosti z EÚ?+

Áno. Všetky modely v katalógu fakturuje jedna európska spoločnosť a vzťahuje sa na ne jedna zmluva o spracúvaní osobných údajov – aj na tie, ktoré bežia u globálnych poskytovateľov. Vo vašich dokladoch tak nefiguruje americký zmluvný partner.

Čo ak potrebný model v katalógu chýba?+

Sprostredkovaný katalóg rozširujeme na požiadanie. Otvorené modely vieme navyše nasadiť na náš hardvér, keď záťaž opodstatní vyhradenú kapacitu – je to otázka objemu, nie princípu.

Ktorý AI model je najlepší?+

Na všetky úlohy žiadny. Pri agentoch na programovanie a prácu s nástrojmi vedú v testoch vývojárov najväčšie modely; na rutinnú extrakciu je malý model rýchlejší a lacnejší; pri slovenských dokumentoch povie pilotný test na vlastných podkladoch viac než akýkoľvek rebríček.

Podporujú modely slovenčinu a češtinu?+

Slovenčinu výslovne neuvádza žiadna karta modelu v katalógu. Češtinu uvádza Granite 4.2 8B; Gemma 4 deklaruje viac než 35 jazykov, Qwen3 32B viac než 100 a Qwen3.5 9B 201, všetky bez zoznamu. Ostatné karty jazyky buď vymenúvajú bez slovenčiny, alebo ich neuvádzajú – prehľad je v tabuľke vyššie.

Sú modely open source?+

Ide o modely s otvorenými váhami: parametre sú zverejnené, trénovacie údaje zvyčajne nie. Väčšina má licenciu Apache 2.0 alebo MIT; Llama, Kimi K3, Qwen3.8 Flash-Next a Nemotron 3 Super majú vlastné licencie s podmienkami a dva komunitné modely licenciu neuvádzajú vôbec.

Je DeepSeek vo firme bezpečný?+

Upozornenie Národného bezpečnostného úradu z prelomu januára a februára 2025 sa týka služby a aplikácie DeepSeek. Otvorené váhy modelu prevádzkujú aj iní – u nás pri každom modeli uvádzame, kde prebieha výpočet, a požiadavky sa nepoužívajú na trénovanie. Posúdenie pre konkrétne použitie zostáva na vašej firme.

Dá sa model spustiť lokálne?+

Váhy sú verejné, takže v zásade áno. Malé modely bežia na jednom serveri; najväčšie modely katalógu potrebujú infraštruktúru na úrovni dátového centra. Pri API nemusíte riešiť ani jedno.

Naposledy aktualizované: