2026. augusztus 29., szombat · Eszközök
AWS új funkcióval oldja meg a SageMaker AI-modellek többzónás rendelkezésre állását
Az AWS hivatalos blogbejegyzése szerint a Salesforce a SageMaker AI Inference Components (IC) technológiával nyolcszorosára csökkentette infrastruktúraköltségeit az Agentforce nevű AI-ügynök platformnál, mivel több modellt oszthat meg közös GPU-kon. A cikk szerint az alapértelmezett elhelyezési algoritmus azonban nem garantálta a Salesforce megfelelőségi elvárása szerinti kétzónás redundanciát, mivel modellpéldányok egyenetlenül oszolhattak el a zónák között, ami instancia- vagy zónaszintű meghibásodás esetén kiesést okozhatott. Az AWS ezért bevezette a CreateInferenceComponent API-ban a SchedulingConfig paramétert, amely finomhangolt kontrollt ad a modellpéldányok zónák közötti elosztására. A bejegyzés a Salesforce egy konkrét, négy instanciás, két zónás példáján mutatja be a megoldást.
Miért fontos?
A hír konkrét technikai megoldást mutat be arra, hogyan lehet költséghatékony GPU-megosztás mellett is teljesíteni a vállalati megbízhatósági követelményeket AI-modellek éles üzemeltetésénél.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. augusztus 29., szombat napi AI összefoglaló része.