2026. szeptember 16., szerda · Eszközök
NVIDIA NVLink 6: többrétegű hibatűrés az AI-gyárak számára
Az NVIDIA saját technikai blogján ismertette az NVLink 6 új, hibatűrő architektúráját, amely a vállalat állítása szerint natívan veszteségmentes hálózatot biztosít az AI-infrastruktúrákhoz. A cég szerint a hibrid előrehaladó hibajavítás, a fizikai rétegbeli újrapróbálkozás és az UPHY-helyreállítás szinte nulla késleltetési büntetéssel javítja a jelhibákat, míg a kreditalapú áramlásvezérlés eleve kizárja a csomagvesztést. Az NMX vezérlő „elzár és lecsapol” állapota és a nagy rendelkezésre állási funkció állítólag másodperceken belül izolálja a hibákat és migrálja a vezérlési funkciókat. A cég közlése szerint az NVIDIA Dynamo Shadow Engine Recovery funkciója B200 GPU-kon 7,3 másodperc alatt állítja helyre az inferenciakapacitást a hidegindítás 283 másodpercéhez képest, az NCCL cuda-checkpoint prototípusa pedig év végére válhat általánosan elérhetővé. Az NVLink Fusion ugyanezt a hibatűrési rétegkészletet terjeszti ki külső fejlesztésű XPU-kra is.
Miért fontos?
Az NVIDIA szerint a Dynamo Shadow Engine 7,3 másodperces helyreállítása közvetlenül csökkentheti az inferenciaszolgáltatók bevételkiesését, míg az NVLink Fusion révén harmadik féltől származó chipek is bekapcsolódhatnak az NVIDIA hálózati ökoszisztémájába.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. szeptember 16., szerda napi AI összefoglaló része.