2026. augusztus 17., hétfő · Üzlet

Az agentikus AI miatt visszatér a CPU-hiány a felhőben

Az IEEE Spectrum cikke szerint az Amazon Web Services idén arra utasította mérnökeit, hogy takarékoskodjanak a CPU-kapacitással, mivel állítólag jelentősen megnőttek a szerverek várakozási idői. A GPU- és memóriaigény után most a processzorok kerülnek a középpontba, mert az önállóan működő, más ügynököket is indító AI-rendszerek rengeteg eszközhívást, API-kommunikációt és feladatelosztást végeznek, ezek pedig jellemzően CPU-n futnak. Matt Kimball (Moor Insights & Strategy) szerint 2026-ban ugrásszerűen nőtt a CPU-kereslet az agentikus AI miatt, míg Intel és AMD szakértői azt állítják, hogy egy tipikus agentikus AI-folyamat lépéseinek nagy része, akár hét a nyolcból, kifejezetten CPU-n zajlik. Ezek a cégek és elemzők saját tapasztalataikra és teszteredményeikre hivatkoznak, függetlenül igazolt, széles körű mérés egyelőre nem áll mögöttük.

Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.

Miért fontos?

Ha beigazolódik, hogy az agentikus AI a CPU-kapacitást is szűk keresztmetszetté teszi, az alapjaiban módosíthatja a felhőszolgáltatók infrastruktúra-fejlesztési prioritásait.

Források

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 17., hétfő napi AI összefoglaló része.

Kapcsolódó hírek

TBC és AWS: idegsejt-mérésekből származó szoftverréteg ígér olcsóbb AI-videót

A San Franciscó-i The Biological Computing Co. (TBC) és az Amazon Web Services bejelentése szerint közösen indítanak egy úgynevezett „neuron-eredetű” szöveg-videó AI modellt. A cég állítása szerint a technológia egy meglévő nyílt forráskódú videómodellre épül, és annak működését ötször gyorsabbá, 80 százalékkal olcsóbbá teszi jobb minőség mellett, bár azt nem közölték, melyik alapmodellről van szó. A gyorsítást egy apró, a bázismodell méretét kevesebb mint 0,1 százalékkal növelő szoftverréteg adja, amelyet laborban tenyésztett agykérgi idegsejtek 4096 elektródás chipen mért jelterjedési és lecsengési mintázataiból vezettek le; a forrás kifejezetten hangsúlyozza, hogy maguk a neuronok sosem hagyják el a labort, és a végtermék teljesen hagyományos szoftverként, szabványos AI-infrastruktúrán fut. A modellt AWS Trainium chipeken futtatnák, Amazon SageMaker AI-n keresztül szolgáltatnák, és az AWS Marketplace-en árulnák, egyelőre azonban minden csak terv: jelenleg kizárólag korai hozzáférésre lehet feliratkozni, működő termék még nincs. A TBC-t idegsebészek alapították, és 2026 februárjában 25 millió dolláros tőkebevonást zártak.

Az Amazon Quick asztali kliens elérhetővé vált, új mobil aktivitás-hírfolyóval bővült

Az AWS bejelentése szerint az Amazon Quick asztali alkalmazása mostantól általánosan elérhető macOS-en és Windowson, a korábbi előzetes teszt után. Az AWS emellett új aktivitás-hírfolyamot vezetett be a mobil alkalmazáshoz iOS-re és Androidra, amely egy nézetbe gyűjti az e-maileket, a naptárat, a CRM- és üzenetküldő adatokat, míg az ügynökök a rutinfeladatokat a háttérben intézik. A vállalat szerint az adatok a felhasználó saját AWS-környezetében maradnak, a beszélgetések privátak, és a rendszer megfelel a HIPAA, FedRAMP, SOC 2 és ISO 27001 szabványoknak, az auditálást a CloudWatch és CloudTrail biztosítja. Az AWS állítása szerint gyártási, egészségügyi és sportipari ügyfelek már használták a desktop verziót az előzetes fázisban.

Az AWS egyedi AI-chipeket tervez a Qualcommal, cserébe a Bedrockot kapja

A The Decoder cikke szerint az Amazon és a Qualcomm több chipgenerációra szóló együttműködést kötött, amelynek fókusza az AI-következtetési (inference) feladatokra optimalizált egyedi processzorok fejlesztése. A két cég emellett akár 1,6 terabit/s sávszélességű optikai összeköttetéseken is dolgozik az AI-infrastruktúra növekvő adatforgalmának kezelésére. A Qualcomm energiahatékony chiptervezési tapasztalatát adja, az Amazon a felhőinfrastruktúráját, cserébe a Qualcomm az Amazon Bedrock szolgáltatását használja saját chiptervezési folyamatának felgyorsítására. A cikk szerint ez a Qualcomm harmadik nagy adatközponti üzlete június óta: a Meta a Dragonfly C1000 szerverprocesszort veszi át, a Microsoft pedig a Qualcomm HBC memóriaarchitektúráját vezeti be az Azure-ban. A Qualcomm célja, hogy 2029-re 15 milliárd dolláros adatközponti bevételt érjen el.

Dél-Korea 3,49 milliárd dollárt szán saját frontier AI-modellre

Dél-Korea kormánya a 2027-es költségvetési javaslat részeként 4,7 billió won, azaz mintegy 3,49 milliárd dolláros állami tőkebefektetést tervez egy hazai fejlesztésű, Kína legjobb nyílt modelljeivel versenyképes AI-rendszer létrehozására, bár a parlamentnek még jóvá kell hagynia a tervet. Egy második finanszírozási csatorna a koreai modellek hazai gazdasági alkalmazását támogatná. A jelenlegi versenyben LG AI Research, SK Telecom és Upstage versenyeznek, de a kormány nyílt pályázatot indít, amelybe start-upok is beszállhatnak, és a mostani két döntős nem kap automatikusan további forrást. Tisztviselők szerint Korea nem tud versenyezni a legnagyobb amerikai cégekkel, de felzárkózhat a vezető kínai nyílt modellekhez. Az új összeg mintegy kilencszerese a korábbi, öt kiválasztott vállalatnak juttatott 530 milliárd wonos (kb. 390 millió dolláros) támogatásnak, miközben Google, Amazon, Microsoft és Meta együttesen 725 milliárd dollárt tervez befektetni 2026-ban, főként AI-adatközpontokba.