2026. augusztus 13., csütörtök · Modellek
Alibaba 2,4 billió paraméteres Qwen-modellje NVIDIA GB300 chipeken fut
Az NVIDIA technikai blogja szerint az Alibaba nyílt súlyokkal publikálta a Qwen3.8-2.4T-A95B (Qwen3.8-Max) modellt, eddigi legnagyobb nyílt modelljét: 2,4 billió összparaméterrel, tokenenként 95 milliárd aktivált paraméterrel, finomszemcsés MoE-architektúrával és teljes, illetve lineáris figyelmet vegyítő megoldással, amely akár egymillió tokenes kontextust és 128 ezer tokenes kimenetet kezel. Az NVIDIA saját mérése szerint a modell külön finomhangolás nélkül, FP8 pontosságon már az első napon GPU-nkánt 4000, felhasználónkénti pedig 350 tokent másodpercenként ér el GB300 NVL72 rendszeren. A cég szerint a jövőben tervezett NVFP4 pontosság további teljesítménynövekedést hozhat, ez azonban még csak kilátás, nem mért eredmény.
Miért fontos?
Egy 2,4 billió paraméteres, nyílt súlyú, akár egymillió tokenes kontextust kezelő modell gyakorlati, nagy sebességű futtatása jelentős lépés az agentikus AI-alkalmazások skálázásában.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. augusztus 13., csütörtök napi AI összefoglaló része.