Katalóg
Qwennáš hardvér · EHP

Qwen3.8 27B (NVFP4)

Qwen3.8 27B je kompaktný hustý (dense) model tímu Qwen, vydaný v auguste 2026 pod licenciou Apache 2.0. Vývojári ho určili na programovanie, výskumné úlohy a dlhé agentové pracovné postupy – plánovanie vo viacerých krokoch s volaním nástrojov – a okrem textu číta aj obrázky a naskenované dokumenty. Režim uvažovania sa dá zapnúť alebo vypnúť pri každej požiadavke. Prevádzkujeme ho na našom hardvéri v EHP; požiadavky ani odpovede sa neukladajú.

ID modelu: qwen38

from openai import OpenAI client = OpenAI(    api_key="hb-...",    base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create(    model="qwen38",    messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
Kontext
256K tokenov
Prevádzka
Náš hardvér · EHP
Volanie nástrojov
Uvažovanie
Štruktúrovaný výstup
Obrazový vstup
Vstup
0,40 $/ 1M
Vstup z cache
0,05 $/ 1M
Výstup
3,00 $/ 1M

Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.

O modeli

Vývojár
Qwen (Alibaba)
Vydaný
august 2026
Licencia
Apache-2.0
Architektúra
hustá (dense) · 27 mld. parametrov
Vstup
text, obrázky, video
Uvažovanie
prepína sa pre každú požiadavku
Jazyky, ktoré uvádza vývojár
na karte modelu nie sú uvedené

Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.

Ktorý variant Qwen3.8 27B to je?

Qwen3.8 27B je pôvodný model tímu Qwen – ten určený na produkčné nasadenie. Nie je to Qwen3.8-Max, samostatný a oveľa väčší model, o ktorom píše väčšina správ o „Qwen 3.8“.

Qwen3.8 27B Uncensored (OrcaRouter) odstraňuje z váh „smer odmietania“ a zachováva obrazový vstup, volanie nástrojov aj uvažovanie; autor nameral pokles odmietnutí pri škodlivých požiadavkách zo 64–99 % na 0–6 %, pričom výsledky v MMLU, GSM8K a CMMLU sa zmenili najviac približne o jeden bod. Qwen3.8 27B Obliterated (OBLITERATUS) odstraňuje odmietanie inou úpravou váh; jeho autor uvádza pokles približne o dva body v MMLU. Oba sú určené na výskum a red-teaming.

Qwen3.8 27B Queen je doladený na hranie rolí a beletriu, Qwen3.8 27B Fable je mierne doladená verzia na konverzáciách asistenta a programátorského agenta. Na Hugging Face existujú aj ďalšie „uncensored“ verzie toho istého základného modelu – ktorý repozitár poskytujeme my, uvádza pole „Otvorené váhy“ v technických údajoch.

Licencia: čo znamená pre vašu firmu

Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Zhrnutie licencie, nie právne poradenstvo.

Výsledky testov podľa vývojára

Terminal Bench 2.1
73
SWE-bench Pro
61,7
GPQA Diamond
89,2
LiveCodeBench v6
90,3
OSWorld-Verified
84,3
OmniDocBench 1.5
91,1

Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: huggingface.co/Qwen/Qwen3.8-27B

Nastavenia odporúčané vývojárom

  • s uvažovaním: temperature 1, top_p 0,95
  • bez uvažovania: temperature 0,7, top_p 0,8, presence_penalty 1,5

Zdroj: huggingface.co/Qwen/Qwen3.8-27B

Technické údaje

Kontextové okno
256K tokenov
Maximálny výstup
32 768 tokenov
Limit priepustnosti
4M tok/min
Tokenizer
Qwen
Streamovanie
áno
Otvorené váhy
Qwen/Qwen3.8-27B
Podporované parametre
max_tokens
1 … 32768
temperature
0 … 2
top_p
0 … 1
frequency_penalty
-2 … 2
presence_penalty
-2 … 2
stop
array
seed
integer
Spracovanie v EHP, bez logovania

Tento model beží na grafických kartách, ktoré prevádzkujeme v Európskom hospodárskom priestore. Požiadavky a odpovede sa nezapisujú do logov ani do trvalého úložiska a nič z nich sa nepoužíva na trénovanie. Na tomto modeli sme namerali všetko, čo uvádza stránka o infraštruktúre: približne 176 tokenov za sekundu, prvý token do jednej sekundy a 91 až 97 % požiadaviek obslúžených z vyrovnávacej pamäte (cache) pri agentovej záťaži.

Otázky k tomuto modelu

Kde beží Qwen3.8 27B?

V Európskom hospodárskom priestore, na grafických kartách, ktoré prevádzkujeme sami. Katalóg uvádza miesto spracovania pri každom modeli – dozornému orgánu viete odpovedať bez toho, aby ste sa pýtali nás.

Ukladá Qwen3.8 27B požiadavky a odpovede?

Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.

Aké veľké je kontextové okno modelu Qwen3.8 27B?

256K tokenov, z toho najviac 32 768 tokenov na výstupe.

Koľko stojí Qwen3.8 27B?

0,40 $ za milión vstupných tokenov a 3,00 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.

Má Qwen3.8 27B limit priepustnosti?

Áno, 4M tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.

Rozumie Qwen3.8 27B po slovensky?

Karta modelu neuvádza žiadne jazyky, teda ani slovenčinu. Model si pred nasadením overte na vlastných slovenských podkladoch.

Pod akou licenciou vyšiel model Qwen3.8 27B?

Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.

Dá sa pri modeli Qwen3.8 27B vypnúť uvažovanie?

Áno. Podľa vývojára sa uvažovanie dá zapnúť alebo vypnúť pri každej požiadavke.

Porovnanie s podobnými modelmi

ModelVývojárParametreKontextLicenciaVstup / 1 mil.
Qwen3.8 27B (NVFP4)Qwen (Alibaba)27B256KApache-2.00,40 $
Qwen3.8 27B Uncensored (NVFP4)OrcaRouter27B512KApache-2.00,20 $
Qwen3 32BQwen (Alibaba)32,8B128KApache-2.00,12 $
Qwen3.6 35B A3BQwen (Alibaba)35B / 3B256KApache-2.00,15 $

30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.

Pozrieť si katalóg

Naposledy aktualizované: