Qwen3.8 27B (NVFP4)
Qwen3.8 27B je kompaktný hustý (dense) model tímu Qwen, vydaný v auguste 2026 pod licenciou Apache 2.0. Vývojári ho určili na programovanie, výskumné úlohy a dlhé agentové pracovné postupy – plánovanie vo viacerých krokoch s volaním nástrojov – a okrem textu číta aj obrázky a naskenované dokumenty. Režim uvažovania sa dá zapnúť alebo vypnúť pri každej požiadavke. Prevádzkujeme ho na našom hardvéri v EHP; požiadavky ani odpovede sa neukladajú.
ID modelu: qwen38
from openai import OpenAI client = OpenAI( api_key="hb-...", base_url="https://api.heabsy.com/v1",) r = client.chat.completions.create( model="qwen38", messages=[{"role": "user", "content": "Hello"}],)print(r.choices[0].message.content)
curl https://api.heabsy.com/v1/chat/completions \ -H "Authorization: Bearer $HEABSY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "qwen38", "messages": [{"role": "user", "content": "Hello"}] }'
import OpenAI from "openai"; const client = new OpenAI({ apiKey: process.env.HEABSY_API_KEY, baseURL: "https://api.heabsy.com/v1",}); const r = await client.chat.completions.create({ model: "qwen38", messages: [{ role: "user", content: "Hello" }],});console.log(r.choices[0].message.content);
Cenník, stav: 12. septembra 2026. Bez minimálneho odberu a bez predplatného.
O modeli
- Vývojár
- Qwen (Alibaba)
- Vydaný
- august 2026
- Licencia
- Apache-2.0
- Architektúra
- hustá (dense) · 27 mld. parametrov
- Vstup
- text, obrázky, video
- Uvažovanie
- prepína sa pre každú požiadavku
- Jazyky, ktoré uvádza vývojár
- na karte modelu nie sú uvedené
Zdroj: karta modelu od vývojára, stav k 17. septembru 2026.
Ktorý variant Qwen3.8 27B to je?
Qwen3.8 27B je pôvodný model tímu Qwen – ten určený na produkčné nasadenie. Nie je to Qwen3.8-Max, samostatný a oveľa väčší model, o ktorom píše väčšina správ o „Qwen 3.8“.
Qwen3.8 27B Uncensored (OrcaRouter) odstraňuje z váh „smer odmietania“ a zachováva obrazový vstup, volanie nástrojov aj uvažovanie; autor nameral pokles odmietnutí pri škodlivých požiadavkách zo 64–99 % na 0–6 %, pričom výsledky v MMLU, GSM8K a CMMLU sa zmenili najviac približne o jeden bod. Qwen3.8 27B Obliterated (OBLITERATUS) odstraňuje odmietanie inou úpravou váh; jeho autor uvádza pokles približne o dva body v MMLU. Oba sú určené na výskum a red-teaming.
Qwen3.8 27B Queen je doladený na hranie rolí a beletriu, Qwen3.8 27B Fable je mierne doladená verzia na konverzáciách asistenta a programátorského agenta. Na Hugging Face existujú aj ďalšie „uncensored“ verzie toho istého základného modelu – ktorý repozitár poskytujeme my, uvádza pole „Otvorené váhy“ v technických údajoch.
Licencia: čo znamená pre vašu firmu
Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
Zhrnutie licencie, nie právne poradenstvo.
Výsledky testov podľa vývojára
- Terminal Bench 2.1
- 73
- SWE-bench Pro
- 61,7
- GPQA Diamond
- 89,2
- LiveCodeBench v6
- 90,3
- OSWorld-Verified
- 84,3
- OmniDocBench 1.5
- 91,1
Údaje z karty modelu od vývojára, nie naše meranie. Zdroj: huggingface.co/Qwen/Qwen3.8-27B
Nastavenia odporúčané vývojárom
- s uvažovaním: temperature 1, top_p 0,95
- bez uvažovania: temperature 0,7, top_p 0,8, presence_penalty 1,5
Technické údaje
- Kontextové okno
- 256K tokenov
- Maximálny výstup
- 32 768 tokenov
- Limit priepustnosti
- 4M tok/min
- Tokenizer
- Qwen
- Streamovanie
- áno
- Otvorené váhy
- Qwen/Qwen3.8-27B
- max_tokens
- 1 … 32768
- temperature
- 0 … 2
- top_p
- 0 … 1
- frequency_penalty
- -2 … 2
- presence_penalty
- -2 … 2
- stop
- array
- seed
- integer
Tento model beží na grafických kartách, ktoré prevádzkujeme v Európskom hospodárskom priestore. Požiadavky a odpovede sa nezapisujú do logov ani do trvalého úložiska a nič z nich sa nepoužíva na trénovanie. Na tomto modeli sme namerali všetko, čo uvádza stránka o infraštruktúre: približne 176 tokenov za sekundu, prvý token do jednej sekundy a 91 až 97 % požiadaviek obslúžených z vyrovnávacej pamäte (cache) pri agentovej záťaži.
Otázky k tomuto modelu
›Kde beží Qwen3.8 27B?
V Európskom hospodárskom priestore, na grafických kartách, ktoré prevádzkujeme sami. Katalóg uvádza miesto spracovania pri každom modeli – dozornému orgánu viete odpovedať bez toho, aby ste sa pýtali nás.
›Ukladá Qwen3.8 27B požiadavky a odpovede?
Nie. Model beží bez uchovávania údajov: obsah požiadaviek sa nezapisuje do trvalého úložiska a nič z neho sa nepoužíva na trénovanie.
›Aké veľké je kontextové okno modelu Qwen3.8 27B?
256K tokenov, z toho najviac 32 768 tokenov na výstupe.
›Koľko stojí Qwen3.8 27B?
0,40 $ za milión vstupných tokenov a 3,00 $ za milión výstupných tokenov. Bez minimálneho odberu a bez predplatného; ten istý cenník platí pre rozhranie aj pre faktúru.
›Má Qwen3.8 27B limit priepustnosti?
Áno, 4M tokenov za minútu. Vyšší limit je otázka objemu, nie princípu.
›Rozumie Qwen3.8 27B po slovensky?
Karta modelu neuvádza žiadne jazyky, teda ani slovenčinu. Model si pred nasadením overte na vlastných slovenských podkladoch.
›Pod akou licenciou vyšiel model Qwen3.8 27B?
Apache-2.0. Permisívna open source licencia: model môžete používať, upravovať a komerčne nasadzovať aj v produktoch, ktoré predávate; pri ďalšom šírení váh k nim musíte priložiť text licencie a upozornenia na autorské práva.
›Dá sa pri modeli Qwen3.8 27B vypnúť uvažovanie?
Áno. Podľa vývojára sa uvažovanie dá zapnúť alebo vypnúť pri každej požiadavke.
Porovnanie s podobnými modelmi
| Model | Vývojár | Parametre | Kontext | Licencia | Vstup / 1 mil. |
|---|---|---|---|---|---|
| Qwen3.8 27B (NVFP4) | Qwen (Alibaba) | 27B | 256K | Apache-2.0 | 0,40 $ |
| Qwen3.8 27B Uncensored (NVFP4) | OrcaRouter | 27B | 512K | Apache-2.0 | 0,20 $ |
| Qwen3 32B | Qwen (Alibaba) | 32,8B | 128K | Apache-2.0 | 0,12 $ |
| Qwen3.6 35B A3B | Qwen (Alibaba) | 35B / 3B | 256K | Apache-2.0 | 0,15 $ |
30 ďalších modelov cez ten istý kľúč a na tej istej faktúre.
Pozrieť si katalógNaposledy aktualizované: