Bemutatta nyílt forráskódú Hy3 AI-modelljét a Tencent, 5x nagyobb modellek teljesítményét hozza
A Tencent Hy3 modellje 21 milliárd aktív paraméterrel és 256 ezer tokenes kontextussal, állítása szerint 5x nagyobb modellek teljesítményét hozza.

A Tencent bemutatta Hy3 nevű nyílt forráskódú AI-modelljét. A Mixture-of-Experts (MoE) architektúrát használó modell 295 milliárd teljes paraméterrel rendelkezik, ebből 21 milliárd aktív egy adott időben, kiegészítve egy 3,8 milliárd paraméteres MTP réteggel. A Hy3 akár 256 000 token hosszúságú kontextust is képes kezelni.
A Tencent állítása szerint a Hy3 teljesítménye megegyezik az aktív méretét két-ötszörös modellekkel. Belső tesztek alapján a modell hallucinációs rátája 12,5%-ról 5,4%-ra csökkent. Egy 270 szakértő részvételével zajló vakértékelésen a Hy3 2,67/4 pontot ért el, megelőzve a GLM-5.1-et, amely 2,51/4 pontot kapott — közölte a The Decoder.
Kapcsolódó: Adatkinyerési teljesítmény
A Hy3 Apache 2.0 licenc alatt érhető el a Hugging Face, a ModelScope és a GitHub platformokon. Egy FP8-kvantált verzió is napvilágot látott. Tervezik az integrációját olyan platformokkal, mint az OpenRouter és a Cline.
Kapcsolódó: GLM-5.2 SWE-bench teljesítmény
A Tencent már beépítette a modellt saját termékeibe, többek között a WorkBuddy, Yuanbao, WeChat és a „Path of Exile: Advent” játék asszisztensébe.
Kapcsolódó: LLM-k programozási képességei