2026. szeptember 5., szombat · Eszközök
NVIDIA: kompakt nyílt AI-modellek futnak a Jetson edge-eszközökön
Az NVIDIA technikai blogja szerint a 2026-ban megjelent kompakt nyílt modellek, mint a Nemotron 3.5 Lightning (mixture-of-experts, 30 milliárd paraméter, tokenenként 3 milliárd aktív) és a Qwen3.8-27B (sűrű modell, mind a 27 milliárd paraméter aktív), már helyben futtathatók az NVIDIA Jetson platformon. A vállalat állítása szerint az NVFP4 kvantálás és a spekulatív dekódolás kombinációja a BF16-hoz képest akár 6,28-szoros dekódolási sebességnövekedést biztosít. A cikk szerint a leggyorsabb spekulatív dekódolási módszer modellenként eltér: a Nemotron 3.5 Lightninghoz a DSpark, a Qwen3.8-27B-hez a DFlash2 illik legjobban. Az NVIDIA hangsúlyozza, hogy az általános benchmarkok önmagukban nem garantálják a konkrét munkaterheléshez szükséges viselkedés megőrzését, ezért alkalmazásspecifikus tesztelés szükséges.
Miért fontos?
A fejlesztés szerint a korábban csak adatközpontban futtatható agentikus AI-képességek most helyben, hálózati függőség és adatkiszivárgási kockázat nélkül elérhetők edge-eszközökön.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. szeptember 5., szombat napi AI összefoglaló része.