2026. július 7., kedd · Modellek
A Tencent kiadta a Hy3 nyílt forráskódú MI-modellt, amely állítása szerint ötször nagyobb modellekkel is felveszi a versenyt
A Tencent hivatalosan kiadta Hy3 nevű MI-modelljét, amely Mixture-of-Experts (MoE) architektúrát használ: összesen 295 milliárd paraméterrel rendelkezik, de egyszerre csak 21 milliárd aktív, kiegészítve egy 3,8 milliárd paraméteres MTP réteggel, és akár 256 000 token hosszú kontextust is képes kezelni. A Tencent állítása szerint a modell a nálánál két-ötször nagyobb modellek teljesítményét éri el, míg 270 szakértő vak értékelésében 2,67-es pontot kapott a 4-ből, felülmúlva a GLM-5.1-et (2,51). A cég belső tesztjei alapján a hallucinációs arány 12,5 százalékról 5,4 százalékra csökkent. A modell Apache 2.0 licenc alatt érhető el a Hugging Face-en, a ModelScope-on és a GitHubon, FP8-kvantált változatban is, és a Tencent már integrálta saját termékeibe, köztük a WeChat-be és a Yuanbao platformba.
Miért fontos?
Egy nagy technológiai cég nyílt licenccel adott ki olyan MoE-modellt, amely alacsony aktív paraméterszámmal kíván versenyezni a jóval nagyobb modellekkel.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. július 7., kedd napi AI összefoglaló része.