2026. augusztus 13., csütörtök · Modellek
Alibaba 2,4 billió paraméteres Qwen-modellje NVIDIA GB300 chipeken fut
Az NVIDIA technikai blogja szerint az Alibaba nyílt súlyokkal publikálta a Qwen3.8-2.4T-A95B (Qwen3.8-Max) modellt, eddigi legnagyobb nyílt modelljét: 2,4 billió összparaméterrel, tokenenként 95 milliárd aktivált paraméterrel, finomszemcsés MoE-architektúrával és teljes, illetve lineáris figyelmet vegyítő megoldással, amely akár egymillió tokenes kontextust és 128 ezer tokenes kimenetet kezel. Az NVIDIA saját mérése szerint a modell külön finomhangolás nélkül, FP8 pontosságon már az első napon GPU-nként több mint 4000, felhasználónként pedig több mint 350 tokent másodpercenként ér el GB300 NVL72 rendszeren. A cég szerint a jövőben tervezett NVFP4 pontosság további teljesítménynövekedést hozhat, ez azonban még csak kilátás, nem mért eredmény.
Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.
Miért fontos?
Egy 2,4 billió paraméteres, nyílt súlyú, akár egymillió tokenes kontextust kezelő modell gyakorlati, nagy sebességű futtatása jelentős lépés az agentikus AI-alkalmazások skálázásában.
Források
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. augusztus 13., csütörtök napi AI összefoglaló része.
Helyesbítés · 2026. október 1., csütörtök
Helyesbítés (2026-10-01): az összefoglaló pontértékként közölte, hogy „GPU-nkánt 4000, felhasználónkénti pedig 350 tokent” ér el a modell; a forrás alsó korlátot ad (több mint 4000, illetve 350).