Tencent Hunyuan, divízia čínskej spoločnosti Tencent vyvíjajúca rodinu jazykových modelov Hy, v piatok 28. augusta 2026 vydala a open-sourcovala model Hy4 preview. Ide o model novej generácie s architektúrou zmesi expertov (Mixture-of-Experts, MoE), ktorý má celkovo 770 miliárd parametrov, no vďaka spomínanej architektúre sa pri spracovaní jedného tokenu aktivuje len približne 49 miliárd z nich — čo umožňuje udržať výpočtovú náročnosť pri inferencii výrazne nižšiu, než by zodpovedalo hustému modelu rovnakej celkovej veľkosti.
Chrbtica modelu pozostáva zo 78 vrstiev, pričom prvá vrstva používa štandardnú hustú (dense) architektúru feed-forward siete a zvyšných 77 vrstiev nahrádza architektúrou MoE — každá obsahuje 256 smerovaných expertov a jedného zdieľaného experta, pričom pri každom tokene sa aktivuje osem najvhodnejších smerovaných expertov spolu so zdieľaným expertom. Model navyše obsahuje samostatnú natívnu MTP vrstvu (10 miliárd celkových, 0,7 miliardy aktivovaných parametrov) určenú na takzvané špekulatívne dekódovanie, ktoré zrýchľuje generovanie textu. Architektúra pozornosti, inšpirovaná modelmi DeepSeek a GLM, využíva takzvanú Gated DeepSeek Sparse Attention s technológiou IndexCache na opätovné využitie riedkych indexov naprieč vrstvami.
Model podporuje kontextové okno presahujúce milión tokenov, čo mu umožňuje spracovávať rozsiahle programátorské repozitáre, dlhé výskumné materiály alebo veľké súbory firemných dokumentov naraz. Tencent Hy4 preview zameral predovšetkým na praktické produktívne úlohy — programovanie, kancelársku prácu, vývoj hier a vedecký výskum. Pri softvérovom inžinierstve má model podľa Tencentu vylepšené porozumenie, plánovanie, ladenie a validáciu pri dlhších vývojárskych úlohách, vrátane schopnosti vybudovať od základu komplexné frontendové projekty. Pri vývoji hier dokáže generovať hrateľné prototypy z jediného promptu a kompletné demá priamo v prostredí Unity. Pri vedeckom výskume má zrýchľovať úlohy ako molekulárne dynamické simulácie, fyziku kondenzovaných látok a základnú matematiku.
K vylepšeniu výkonu na reálnych úlohách podľa Tencentu prispela spolupráca s expertmi naprieč rôznymi biznis divíziami firmy — softvérovým inžinierstvom, vývojom hier, financiami a bezpečnosťou — ktorí sa podieľali na zbere dát a tvorbe reálnych testovacích scenárov.
Model je dostupný ako open-source s otvorenými váhami pod licenciou Apache 2.0, publikovaný na Hugging Face, ModelScope, GitCode aj CNB — posledné tri platformy majú zabezpečiť prístup aj pre vývojárov, ktorí sa z pevninskej Číny k Hugging Face nedostanú jednoducho. Tencent súčasne s plnou verziou zverejnil aj variant Hy4 preview-FP8 s nižšou presnosťou, určený pre nasadenie na menej výkonnom alebo edge hardvéri.
Model je zároveň priamo integrovaný do produktov Tencentu — čínskej aj medzinárodnej verzie nástrojov WorkBuddy a CodeBuddy, ako aj aplikácií Yuanbao a ima. Prístup cez API ponúka Tencent Cloud TokenHub a platforma OpenRouter, s cenou 0,834 dolára za milión vstupných tokenov a 2,501 dolára za milión výstupných tokenov. WorkBuddy a CodeBuddy budú počas prvých dvoch týždňov po spustení ponúkať bezplatný prístup k modelu.
Podľa internej "slepej" evaluácie, na ktorej sa podieľalo 163 expertov posudzujúcich 203 inžinierskych úloh, dosiahol Hy4 preview priemerné skóre 2,99 zo 4 bodov, v porovnaní s 2,92 bodu pre model GLM 5.3 a 2,94 bodu pre Kimi K3 — ide však o interné testovanie Tencentu, nezávislé benchmarky zatiaľ k dispozícii nie sú.
Tencent v dokumentácii modelu zároveň otvorene priznáva jeho súčasné obmedzenia — pri niektorých komplexných úlohách môže model "prehnane premýšľať" alebo opakovane overovať svoje vlastné odpovede, čo môže viesť k dlhším odozvám.
Vydanie Hy4 preview nasleduje po predchádzajúcom modeli Hy3, ktorý Tencent vydal 6. júla 2026 s 295 miliardami celkových a 21 miliardami aktívnych parametrov a kontextovým oknom 256-tisíc tokenov — Hy4 preview tak prichádza len 53 dní po Hy3, pričom ponúka 2,6-násobne väčší model so štvornásobne väčším kontextovým oknom. Tencent zároveň predĺžil bezplatný prístup k modelu Hy3 na oboch platformách až do 30. septembra.
Vydanie zapadá do širšieho trendu rýchlo sa vyvíjajúcich čínskych open-source jazykových modelov, ktoré čoraz intenzívnejšie konkurujú uzavretým západným modelom aj domácej konkurencii vrátane modelových rodín Alibaba Qwen, Zhipu GLM a Moonshot Kimi.
