Qwen 3.8 je vonku: čo znamená 2,4 bilióna parametrov a prečo je zaujímavejšia tá menšia verzia

Qwen 3.8 je vonku: čo znamená 2,4 bilióna parametrov a prečo je zaujímavejšia tá menšia verzia
Ilustračné foto: vytvorené umelou inteligenciou (AZOIA)

Alibaba 3. augusta 2026 vypustila do sveta model Qwen3.8-Max s 2,4 bilióna parametrami.

Je to číslo, ktoré znie ako z reklamného letáku, a pre 99 % firiem je úplne nepoužiteľné. Zatiaľ čo všetci budú titulkovať o biliónoch, skutočný prevrat pre bežného používateľa sa volá Qwen3.8-27B — model s otvorenými váhami, ktorý si k 5. augustu 2026 ešte nemôžete stiahnuť, ale ktorý zmení pravidlá hry pre každého, kto nechce posielať firemné dokumenty do cudzieho cloudu.

Čo je vlastne Mixture-of-Experts?

Skôr než sa pustíme do porovnania, musíme si vysvetliť architektúru, inak bude číslo 2,4 bilióna zavádzajúce. Qwen3.8-Max používa Mixture-of-Experts (MoE). To znamená, že model má síce 2,4 bilióna parametrov, ale pri spracovaní každého tokenu sa aktivuje len zlomok z nich — približne 95 miliárd.

Predstavte si to ako obrovskú firmu s 2,4 milióna zamestnancami, kde na každú úlohu nastúpi len špecializovaný tím 95-tisíc ľudí. Zvyšok čaká v zálohe. Vďaka tomu je model schopný udržať si obrovské vedomosti, ale náklady na výpočet sú porovnateľné s modelom, ktorý má „len“ 95 miliárd parametrov.

Pre porovnanie: Qwen3.8-27B je hustý model (dense), čo znamená, že všetkých 27 miliárd parametrov sa aktivuje vždy. Je to menší, ale oveľa predvídateľnejší stroj.

Veľký Max: cloudová záležitosť pre korporácie

Qwen3.8-Max je multimodálny na vstupe (text, obrázok, video), na výstupe produkuje text. Kontextové okno má 1 milión tokenov (991-tisíc na vstupe, 131-tisíc na výstupe). To je dosť na to, aby ste mu poslali celú technickú dokumentáciu projektu alebo niekoľko hodín videa.

Alibaba uvádza benchmarky Terminal-Bench 2.1 na úrovni 86,6 a OSWorld-Verified na 86,1 (MarkTechPost, 2026), čím sa porovnáva s GPT-5.6 Sol a Claude Opus 4.8. To sú pôsobivé čísla pre agentné úlohy — teda pre situácie, kde model nielen odpovedá, ale aj koná (ovláda terminál, pracuje s operačným systémom).

Cena API je 2 doláre za milión vstupných tokenov, 6 dolárov za milión výstupných a 0,25 dolára za milión cachovaných vstupných. To je konkurencieschopná cena, ale pointa nie je v cene. Pointa je v tom, že tento model si nikdy nenasadíte vo vlastnej réžii. Potrebujete na to serverovňu, ktorú si bežná firma nemôže dovoliť. Max je čisto cloudová služba.

Malý 27B: Prečo je to tá zaujímavejšia správa

Súbežne s Maxom Alibaba ohlásila Qwen3.8-27B s otvorenými váhami. Presná licencia zatiaľ nie je známa — predchádzajúci rad Qwen3 používal Apache 2.0, ale nepreberajte to automaticky na 3.8. K 5. augustu 2026 váhy zverejnené nie sú, Alibaba hovorí len „budúci týždeň“ (TechNode, 2026). Čo platí dnes, je len oznámenie.

Prečo je to pre vás dôležitejšie ako bilióny parametrov? Pretože 27 miliárd parametrov je veľkosť, ktorá sa reálne zmestí na jednu profesionálnu grafickú kartu. Hovoríme o GPU s 24 GB VRAM, čo je dnes dostupná trieda hardvéru. S kvantizáciou (znížením presnosti váh) sa to dá stlačiť aj na menej.

To znamená, že si ho môžete prevádzkovať lokálne cez nástroje ako Ollama alebo vLLM. Žiadne API, žiadny cloud, žiadne posielanie dát von.

Otvorené váhy vs. API: Praktický rozdiel

Rozdiel medzi prístupom cez API a otvorenými váhami nie je technický — je to rozdiel v kontrole.

Keď používate API (Qwen3.8-Max), vaše dáta fyzicky opúšťajú vašu infraštruktúru. Pri citlivých firemných dokumentoch, zmluvách, zdravotných záznamoch alebo obchodných stratégiách to môže byť neprípustné. GDPR, interné smernice, zmluvné dohody s klientmi — to všetko môže zakazovať posielať dáta do cudzieho cloudu, aj keby bol najlacnejší na svete.

S otvorenými váhami máte model u seba. Dáta nikam nejdú. Platíte za elektrinu a hardvér, nie za tokeny. A máte plnú kontrolu nad tým, čo sa s modelom deje — môžete ho doladiť na vlastné dáta, orezať funkcie, ktoré nechcete, a nemusíte sa báť, že vám poskytovateľ zmení ceny alebo podmienky.

Nevýhoda? Musíte to prevádzkovať. To znamená náklady na GPU, údržbu, aktualizácie a človeka, ktorý to vie nastaviť. Pre malú firmu to môže byť vyššia prekážka ako pre veľkú, ktorá už má IT oddelenie.

Čo si vybrať?

Ak potrebujete maximálny výkon a nemáte citlivé dáta — Qwen3.8-Max cez API dáva zmysel. Benchmarky na agentné úlohy sú špičkové a cena je prijateľná.

Ak pracujete s citlivými dátami alebo chcete nezávislosť od dodávateľa — počkajte si na Qwen3.8-27B. K 5. augustu 2026 váhy ešte nie sú vonku, ale keď vyjdú, je to model, ktorý si môžete prevádzkovať vo vlastnej réžii. Sledujte oficiálny blog qwen.ai a TechNode, kde sa objaví dátum vydania aj licencia.

Richardov biznis verdikt

Nenechajte sa oslniť číslom 2,4 bilióna — to je cloudová záležitosť pre korporácie s rozpočtom na API. Pre vašu firmu je relevantná až Qwen3.8-27B: ak potrebujete spracovávať citlivé dáta lokálne a máte GPU s 24 GB VRAM, toto je model, na ktorý si počkáte. Sledujte oznámenie o licencii a váhach — ak bude Apache 2.0, je to jasná voľba pre self-hosted nasadenie.

Zdroje

  • MarkTechPost — Qwen3.8-Max Release Coverage, marktechpost.com (citované 5. 8. 2026)
  • TechNode — Qwen3.8 Open-Weight Model Announcement, technode.com (citované 5. 8. 2026)
  • Qwen Blog — Qwen3.8 Official Announcement, qwen.ai (citované 5. 8. 2026)