Sztori-szál · Üzlet
AI-adatközpontok és az energiaigény robbanása
A nagy AI-modellek betanítása és futtatása olyan mennyiségű számítási kapacitást és energiát igényel, amely alapjaiban alakítja át az energiapiacokat és az infrastruktúra-fejlesztést.
Az elmúlt években a mesterséges intelligencia fejlődésének egyik legszűkebb keresztmetszete nem a szoftver, hanem a fizikai infrastruktúra: a chipek, az adatközpontok és az őket tápláló energiaellátás. A nagy nyelvi modellek betanítása és futtatása (inference) olyan GPU-klasztereket igényel, amelyek energiafogyasztása egyes becslések szerint egész országokéval mérhető össze. Ez a szál azokat a fejleményeket követi, amelyek a számítási kapacitás bővítéséhez, az adatközpontok építéséhez és az energiaellátás biztosításához kapcsolódnak.
A tét nem csak technológiai, hanem geopolitikai és környezeti is: a vezető techcégek (Microsoft, Google, Amazon, Meta) versenyt futnak egymással az adatközpont-kapacitás bővítéséért, miközben egyre gyakrabban fordulnak atomenergiához, gázhoz vagy saját erőműfejlesztéshez, hogy biztosítsák a szükséges áramot. Ez helyi közösségekkel, energiapiacokkal és klímacélokkal is konfliktusba kerülhet, miközben a chiphiány és az exportkorlátozások (különösen Nvidia-eszközök esetén) tovább szűkítik a kapacitást.
Érdemes követni ezt a szálat, mert az AI-fejlesztés üteme és költsége egyre inkább attól függ, hogy a szükséges hardver és energia mennyire áll rendelkezésre — ez pedig közvetlenül befolyásolja, mely cégek és országok tudnak versenyképesek maradni az AI-versenyben.
Kapcsolódó szálak és fogalmak
- Nvidia chipexport-korlátozások
- atomenergia és techcégek
- hiperskálázó felhőszolgáltatók
- AI-modellek betanítási költségei
- klímahatás és AI
A szál fejleményei időrendben
-
2026. június 24., szerda Üzlet
Nvidia: az MI újraírja az orvosi munkát
A Nvidia egészségügyi részlegének vezetője, Kimberly Powell szerint a mesterséges intelligencia alapvetően átalakíthatja az orvosok mindennapi munkáját. Az MI képes csökkenteni az egészségügyi dolgozók adminisztratív terheit, ezzel több időt hagyva a betegellátásra. Powell kiemeli, hogy a technológia segíthet megoldani a képzett egészségügyi személyzet globális hiányát is. A Nvidia aktívan dolgozik olyan eszközökön, amelyek a klinikai folyamatokba integrálva javítják a hatékonyságot.
-
2026. június 25., csütörtök Üzlet
Az OpenAI és a Broadcom bemutatta a Jalapeño nevű egyedi AI-chipet
Az OpenAI együttműködve a Broadcommal kifejlesztette saját, egyedi tervezésű mesterséges intelligencia processzorát, amelynek neve Jalapeño. A chip kifejezetten az OpenAI nagy nyelvi modelljeinek (LLM) következtetési (inference) feladataira lett optimalizálva, célja a teljesítmény, a hatékonyság és a skálázhatóság javítása. A vállalat eddig elsősorban Nvidia GPU-kra támaszkodott, az új chip révén azonban csökkenthetné külső beszállítóktól való függőségét. A bejelentés a chipszektort egyébként is mozgásban lévő időszakban érkezett, amelyet a befektetői bizonytalanság és részvényárfolyam-ingadozások jellemeznek.
-
2026. június 25., csütörtök Szabályozás
AI-biztonsági aggodalmak: titkos rendszerek sérülékenységei és tiltott chipek feketepiaca
Az Anthropic Mythos nevű AI-modellje sebezhetőségeket talált az amerikai kormány titkosított rendszereiben, ami komoly biztonsági kérdéseket vet fel. Az Egyesült Államok nyomást gyakorol a Metára, hogy fogadja el az AI-rendszereinek független biztonsági felülvizsgálatát, miután aggodalmak merültek fel a technológia kockázataival kapcsolatban. Kínában az Nvidia tiltott AI-chipjeinek feketepiaci ára megduplázódott az exportkorlátozások következtében. A Wall Street eközben esett, miután a befektetők kételkedni kezdtek az AI-infrastruktúrára fordított hatalmas kiadások megtérülésében, különösen a félvezető szektorban.
-
2026. június 25., csütörtök Üzlet
Az OpenAI bemutatja első saját AI-processzorát: a Jalapeño chipet
Az OpenAI a Broadcommal partnerségben elkészítette első saját mesterséges intelligencia processzorát, amelyet Jalapeño névre kereszteltek. A chip egy ASIC (alkalmazásspecifikus integrált áramkör) típusú processzor, amelyet kifejezetten AI-szerverek számára terveztek. A Jalapeño célja a jelenlegi és jövőbeli nagy nyelvi modellek kiszolgálása. Az OpenAI ezzel csökkenthetné függőségét az Nvidia és más chipgyártóktól.
-
2026. június 25., csütörtök Szabályozás
Megduplázódott a tiltott Nvidia-chipek feketepiaci ára Kínában
Az amerikai exportkorlátozások következtében a Kínában tiltott Nvidia mesterséges intelligencia processzorok feketepiaci ára megkétszereződött. Az Egyesült Államok szigorú intézkedései kockázatosabbá, nehezebbé és drágábbá tették az illegális chipbeszerzést. A fokozott ellenőrzés ellenére a tiltott chipek iránti kereslet Kínában továbbra is erős, mivel a fejlett AI-hardver hozzáférése stratégiai fontossággal bír. A magasabb ár és a nagyobb kockázat dacára a fekete piac aktív maradt, ami jelzi, hogy a korlátozások nem tudták teljesen elvágni a kínai szereplőket a fejlett AI-chiptől.
-
2026. június 26., péntek Üzlet
Chipverseny és tőzsdei nyomás: az OpenAI és riválisai új kihívásokkal szembesülnek
Az OpenAI a Broadcommal közösen bejelentett egy új, nagy nyelvi modellek következtetési feladataira optimalizált egyedi chipet, amellyel csökkenteni kívánják a növekvő számítási kapacitásigénytől való függőséget. Eközben az Anthropic és az OpenAI egyre erősebb versennyel néz szembe a nyílt forráskódú AI-modellek részéről, amelyek olcsóbb és szabadabban elérhető alternatívát kínálnak. A verseny kiéleződése különösen kritikus, mivel mindkét vállalat tőzsdei bevezetés előtt áll, és a befektetőknek be kell bizonyítaniuk üzleti modelljük fenntarthatóságát. A saját chip fejlesztése stratégiai lépés az OpenAI részéről, hogy csökkentse az Nvidia-függőséget és hosszú távon költségeit.
-
2026. június 27., szombat Üzlet
OpenAI saját chipet mutat be, az Alibaba pedig az Anthropic adatait lopta el – az AI-verseny új szintre lép
Az OpenAI bemutatta saját mesterséges intelligencia chipjét, amellyel csökkenteni kívánja függőségét az Nvidia-tól és erősíteni piaci pozícióját. Ezzel párhuzamosan kiderült, hogy az Alibaba kínai AI-modelljét részben az Anthropic Claude válaszainak engedély nélküli felhasználásával tanították be, ami komoly etikai és jogi kérdéseket vet fel. Az AI-láz a technológiai eszközök árait is felfelé hajtja globálisan, miközben az Apple is átírta chipfejlesztési ütemtervét: az M6 Pro és M6 Max sorozatot lemondták, hogy az AI-ra optimalizált M7 generációra összpontosíthassanak. Egy friss tanulmány szerint az AI negatívan befolyásolja a videojátékok eladásait is, jelezve, hogy a technológia hatása már a szórakoztatóiparra is kiterjed.
-
2026. június 27., szombat Üzlet
Az Nvidia uralmának vége felé? Az AI-óriások saját chipeket fejlesztenek
Az Nvidia évek óta dominálja az AI-chipek piacát, de ez az egyeduralom most megrendülni látszik. Az OpenAI bejelentette saját egyedi következtetési chipjét, a Jalapeñót, amelyet a Broadcommal közösen fejleszt. Az OpenAI mellett a Google, az Apple és a SpaceX is saját chipek gyártásába fogott, jelezve, hogy a nagyvállalatok csökkenteni kívánják az Nvidia-függőségüket. Ez a tendencia alapjaiban alakíthatja át az AI-hardverpiac erőviszonyait.
-
2026. június 27., szombat Üzlet
Az OpenAI bemutatja a Jalapeño AI-chipet – Broadcommal közösen épít Nvidia-alternatívát
Az OpenAI bejelentette saját fejlesztésű AI inferencia chipjét, amelyet Jalapeñónak neveztek el, és a Broadcommal közösen gyártanak. A lépéssel az OpenAI csatlakozik a Google, az Apple és a SpaceX sorához, amelyek szintén saját egyedi chipeket fejlesztenek. Az Nvidia évek óta dominálja az AI chipek piacát, ám egyre több nagyvállalat dönt az önálló chipfejlesztés mellett, hogy csökkentse az Nvidiától való függőséget.
-
2026. június 28., vasárnap Üzlet
Az AI-adatközpontok miatti RAM-drágulás hajtja fel az Apple és más techcégek fogyasztói árait
Tim Cook az Apple közelmúltbeli áremeléseit – a MacBook Pro 300, az iPad Air 150, a HomePod Mini 30 dolláros drágulását – "elkerülhetetlennek" nevezte, és az AI-iparágra hivatkozott. A The Verge cikke szerint a memóriagyártók átállították termelésüket az AI-adatközpontoknak szánt HBM-chipekre, ami a fogyasztói DDR5 RAM árának megugrásához vezetett. Carnegie Mellon és NYU Stern üzleti iskolák szakértői szerint ez nem átmeneti jelenség, hanem évekig tarthat, mert az AI-szerverek jövedelmezőbbek a gyártóknak. A cikk ugyanakkor kiemeli, hogy az Apple legalább négy egymást követő negyedévben rekorderedményeket ért el, hardveres árrése pedig 30-40 százalékos, egyes becslések szerint az iPhone 17 Pro esetében akár 47 százalékos lehet.
-
2026. június 29., hétfő Üzlet
A Micron piaci értéke megközelítette a Metáét és a Tesláét az AI-vezérelt memóriachip-kereslet miatt
A Micron részvényárfolyama egy hónap alatt több mint 236%-ot emelkedett, pénteken 1,27 billió dolláros piaci kapitalizációval zárt – megközelítve a Meta (1,39 billió) és a Tesla (1,42 billió) értékelését. A TechCrunch beszámolója szerint a felfutás mögött az AI-adatközpontok építési hulláma áll, amely súlyos hiányt okozott a DRAM-, NAND- és különösen a nagy sávszélességű memóriachipekből (HBM). Az Nvidia és a nagy felhőszolgáltatók – Microsoft, Amazon AWS, Google, Meta, Oracle – hatalmas mennyiségben vásárolják a memóriát, ami a RAMageddon.
-
2026. június 29., hétfő Üzlet
Ausztrál nyugdíjalapok: a megtakarítások akár 12%-a AI- és tech-részvényekben van
Az ausztrál szuperannuációs alapok portfólióinak becslések szerint átlagosan 12%-a mesterséges intelligenciához kötődő vállalatokba – köztük az Nvidia, Apple, Microsoft, Alphabet, Amazon, Meta és Tesla részvényeibe – van fektetve, mivel a globális indexek erősen az amerikai tech-szektor felé tolódtak. Az Asfa szerint sok alap a SpaceX-ben is érdekelt, amely június 12-én a világ eddigi legnagyobb tőzsdei bevezetésével debütált. A Morningstar szakértője szerint a SpaceX közvetlen hatása az ausztrál portfóliókra szerény: az átlagos kitettség tagonként mintegy 50 ausztrál dollár. A tech-túlsúly ugyanakkor etikai és kockázati kérdéseket is felvet.
-
2026. június 30., kedd Kutatás
A Flexion Robotics humanoid robotja önállóan navigál irodai környezetben, szimulációban tanult készségek kombinálásával
A svájci Flexion Robotics – amelyet volt Nvidia-robotikai kutatók alapítottak – egy módosított Unitree humanoid robotot mutatott be, amely szöveges utasítás alapján önállóan hajt végre összetett irodai feladatokat: lépcsőzik, lifttel közlekedik, ajtót nyit, csomagot bont és polcra pakol. A cég állítása szerint a rendszer lényege, hogy az egyes készségeket (járás, egyensúlyozás, tárgyak kezelése) szimulációban tanítják be megerősítéses tanulással, majd egy fő AI-modell – amely emberekről készült videókból tanulja meg a cselekvések sorrendjét – valós időben kombinálja ezeket. A megközelítés a Flexion szerint hatékonyabb a szokásos teleoperált betanításnál, mert kevesebb emberi beavatkozást igényel, és ismeretlen környezetben is működik. A bemutató egyetlen videón alapul, így a rendszer megbízhatóságáról és általánosíthatóságáról egyelőre nem áll rendelkezésre független értékelés.
-
2026. július 1., szerda Üzlet
Zürich a világ egyik legsűrűbb AI-kutatási központjává vált – a Silicon Valley kihívója
A MIT Technology Review beszámolója szerint Zürich és a Nagy-Zürichi Régió az elmúlt két évtizedben a világ egyik legkoncentráltabb technológiai K+F központjává nőtte ki magát: az Apple, Anthropic, Google, Meta, Microsoft, NVIDIA és OpenAI egyaránt működtet ott kutatóbázist. A cikk szerint Svájc több mint tíz éve vezeti a Globális Innovációs Indexet, a világ élén áll az egy főre jutó szabadalmak terén, és GDP-je 3,3%-át fordítja K+F-re. A kockázati tőke több mint 60%-a deep tech területre irányul, ami globálisan a legmagasabb arány. A google.org idén egymillió dolláros támogatást ígért a Svájci Nemzeti AI Intézetnek. A cikk ugyanakkor megjegyzi, hogy a tehetségbázis kis méretű, és a csapatok gyors bővítése nehezebb, mint más európai központokban.
-
2026. július 2., csütörtök Kutatás
Megerősítéses tanulás az AI-ágensek finomhangolásában: NVIDIA útmutató és új kutatási keretrendszerek
Az NVIDIA technikai blogján részletes útmutatót tett közzé arról, hogyan alkalmazható a megerősítéses tanulás (RL) – különösen a verifikálható jutalmakkal történő RL (RLVR) és a GRPO módszer – vállalati AI-ágensek domain-specifikus finomhangolására. A cég szerint a Nemotron 3 Super modellt 21 verifikáló környezetben, mintegy 1,2 millió rollout segítségével képezték, a NeMo RL ökoszisztéma pedig nyílt modellekhez kínál skálázható RL-eszközöket. Emellett két nem lektorált kutatási munka is megjelent: a HyPOLE keretrendszer formális logikával (HyperLTL) vezérli a többágenses RL-t részleges megfigyelhetőség mellett, míg egy másik tanulmány elektromos járművek flottáinak intelligens töltését vizsgálja független többágenses RL-megközelítésekkel. Mindhárom forrás azt jelzi, hogy az RL túllépett az általános modellképzésen, és egyre inkább gyakorlati, specializált feladatokban alkalmazzák.
-
2026. július 4., szombat Üzlet
Az OpenAI 5%-os részesedést ajánlana a Trump-kormánynak az AI-boom hasznából
A Financial Times értesülése szerint Sam Altman, az OpenAI vezérigazgatója korai stádiumú tárgyalásokat folytat a Trump-kormányzattal arról, hogy az Egyesült Államok 5 százalékos tulajdonrészt kapjon a cégben. Altman állítása szerint ez a legjobb módja annak, hogy a köz is részesüljön az AI gazdasági előnyeiből; az ötletet először tavaly vetette fel Trumpnak. A cég legutóbbi, 852 milliárd dolláros értékelése alapján ez a részesedés mintegy 42,6 milliárd dollárt érne. A kormányzat más AI-cégektől – köztük a Google-tól és a Metától – is hasonló ajánlatot kért, de egyikük sem reagált nyilvánosan. A javaslatot a növekvő AI-ellenes közhangulat és a szabályozási nyomás is motiválhatja: friss közvélemény-kutatások szerint az amerikaiak 70%-a ellenzi az AI-adatközpontok építését a lakóhelyén, Bernie Sanders szenátor pedig jóval nagyobb, 50%-os egyszeri adót javasolt.
-
2026. július 4., szombat Eszközök
Az NVIDIA bizalmas számítástechnikája a Blackwell GPU-kon 98%-os teljesítményt nyújt hardveres AI-biztonság mellett
Az NVIDIA műszaki blogján közzétett benchmarkok szerint a Blackwell GPU-kra épülő Confidential Computing (CC) technológia minimális teljesítményveszteséggel biztosít hardverszintű védelmet az AI-inferencia során. A vállalat állítása alapján a HGX B300-on futtatott Qwen 3.5-397B modellel végzett tesztek azt mutatták, hogy a CC bekapcsolása jellemzően 8% alatti áteresztőképesség- és késleltetés-többletet okoz, vagyis a teljesítmény eléri a védelem nélküli megoldás 98%-át. A biztonság alapja a gyártáskor a chipbe égetett privát aláírókulcs, az NVLink titkosítás és a távoli hitelesítés (NRAS). Az NVIDIA kiemeli, hogy optimalizálásokkal – CC-safe autotuning, aszinkron D2H másolás, CUDA-gráf támogatás – sikerült a biztonságos munkabeadás és a titkosított sávszélesség korlátait kompenzálni, így a rendszer termelési szintű, szabályozásnak megfelelő telepítésekre is alkalmas.
-
2026. július 5., vasárnap Üzlet
Az OpenAI láthatóan meg sem látogatta a brit Stargate UK projekt kulcshelyszínét
A Guardian oknyomozása szerint az OpenAI nem látogatta meg a Stargate UK projekt egyik kiemelt helyszínét, a North Tyneside-i Cobalt Parkot, és a brit kormány által beharangozott 30 milliárd fontos beruházási ígéretből mintegy 20 milliárd font pusztán hipotetikus volt. Közérdekű adatigénylés alapján sem az OpenAI, sem partnere, az Nscale nem egyeztetett az érintett helyi hatóságokkal; egyedül az Nvidia tett látogatást 2026 februárjában. A lap forrásai szerint a kormány Trump londoni látogatása előtt sürgősen keresett nagyszabású bejelentést, és az Nscale-t gyakorlatilag utasították a projekt támogatására. Az OpenAI áprilisban szabályozási aggályokra és magas energiaköltségekre hivatkozva felfüggesztette a terveket. A feltárt részletek alapján a Stargate UK az egyik legjelentősebb brit AI-fejlesztési bejelentés helyett inkább sajtóközleménynek tűnik.
-
2026. július 7., kedd Társadalom
Félelem és kiábrándulás egy skót faluban, amelyet AI-adatközpont helyszínéül választottak
A The Guardian beszámolója szerint a skót Lanarkshire-ben található Newarthill lakói egyre inkább úgy érzik, félrevezették őket az AI-adatközpont fejlesztés ígért előnyeivel kapcsolatban. Az Oakes Energy Services képviselői tavaly késő ősszel házról házra járva ajánlottak ingyenes napelemeket, fákat vagy készpénzt az ingatlanokért – a helyiek szerint ezek nem kikényszeríthető, írásos ígéretek. Két hónappal később a brit kormány Lanarkshire-t jelölte ki az egyik AI növekedési övezetnek.
-
2026. július 7., kedd Üzlet
A skóciai AI-adatközpont megújuló energiával való működtetése megvalósíthatatlannak tűnik a Guardian vizsgálata szerint
A Guardian oknyomozása szerint a brit kormány által januárban bejelentett, 8,2 milliárd fontos skóciai (Lanarkshire) AI-adatközpont – amelyet a CoreWeave és a DataVita épít – nem tudja teljesíteni azt az ígéretet, hogy 2030-ra kizárólag helyszíni megújuló energiaforrásokból működjön. Információszabadság-kérelmekkel beszerzett belső levelezésből kiderült, hogy a kormány és a fejlesztők a nyilvános ígéretek idején is tudták, hogy a telephelynek energiaellátási problémája.
-
2026. július 8., szerda Kutatás
Az NVIDIA nemegyenletes tenzorpárhuzamossága csökkenti a GPU-kiesések hatását az LLM-tréningben
Az NVIDIA műszaki blogján bemutatott Nonuniform Tensor Parallelism (NTP) keretrendszer lehetővé teszi, hogy nagy léptékű LLM-tréningek dinamikusan alkalmazkodjanak az átmenetileg elérhetetlenné váló GPU-khoz. Az NVIDIA állítása szerint az NTP az aktív GPU-k órajelének ideiglenes növelésével (dinamikus teljesítménynöveléssel) kompenzálja a kiesést, miközben a tenzor-újrafelosztás okozta többletterhelés 1% alatt marad. A módszer a Blackwell és Blackwell Ultra rendszerek NVLink összeköttetésein akár 72 GPU-s tartományokra is skálázható. Az NTP kísérleti jellegű megközelítés, amely a meglévő rugalmas skálázási technikákat – mint az adatreplikák eldobása vagy gyors ellenőrzőpont-újraindítás – egészíti ki azzal, hogy az áteresztőképesség-veszteséget minimalizálja a csökkentett rendelkezésre állás időszakában.
-
2026. július 8., szerda Eszközök
Az NVIDIA bemutatta a Vera CPU-t, amely 1,8-szoros teljesítménynövekedést ígér az ágens AI munkaterhelésekhez
Az NVIDIA saját közleménye szerint a Vera CPU architektúra 1,8-szoros fenntartott magteljesítményt nyújt teljes foglalatterhelés mellett a hagyományos x86-os adatközponti processzorokhoz képest. A monolitikus chipkialakítás 88 Olympus magot, egységes gyorsítótárat és Scalable Coherency Fabric technológiát tartalmaz, amellyel az NVIDIA állítása szerint 40%-kal alacsonyabb késleltetést és háromszoros magonkénti memória-sávszélességet érnek el a korábbi CPU-k felénél kisebb energiafogyasztás mellett. A cég kiemeli, hogy a Vera CPU csökkenti a GPU-k várakozási idejét az ágens AI rendszerek többlépéses munkafolyamataiban – sandbox-futtatások, eszközhívások, KV-cache koordináció terén –, ezáltal javítva a megerősítéses tanulás áteresztőképességét és a rendszerszintű hatékonyságot.
-
2026. július 9., csütörtök Üzlet
A SambaNova 1 milliárd dolláros tőkét vont be 11 milliárd dolláros értékeléssel
A SambaNova Systems AI-chipgyártó startup 1 milliárd dolláros befektetést zárt le Series F körében, 11 milliárd dolláros vállalati értékelés mellett, a General Atlantic vezetésével – közölte a TechCrunch. A kör még nem zárult le teljesen: a cég vezérigazgatója, Rodrigo Liang szerint heteken belül további befektetők csatlakoznak. Az új forduló mindössze öt hónappal a 350 millió dolláros Series E után érkezett. A vállalat az Intel-lel többéves partnerséget épít az AI-inferencia területén, és bejelentette, hogy a JPMorganChase inferencia-infrastruktúra-partnernek választotta a SambaNovát, SN40L és SN50 rendszereivel. Liang szerint az akvizíció lehetősége nyitott, de a növekedés inkább a tőzsdei bevezetés irányába terelheti a céget.
-
2026. július 9., csütörtök Üzlet
A Prime Intellect 130 millió dolláros A sorozatú befektetést kapott, egymilliárd dolláros értékeléssel
A Prime Intellect startup 130 millió dolláros Series A finanszírozási kört zárt le egymilliárd dolláros vállalatértékelés mellett. A kört a Radical Ventures vezette, és többek között az Nvidia Ventures, az Intel Capital és a Dell Technologies Capital is részt vett benne. A 2024-ben alapított vállalat célja, hogy a szervezetek a nagy AI-laboroktól függetlenül fejleszthessenek saját AI-ágenseket, ehhez számítási kapacitást, megerősítéses tanulási keretrendszert és kiértékelő eszközöket kínál egyetlen platformon. A TechCrunch beszámolója szerint a cég ügyfelei között szerepel a Ramp, a Zapier és más vállalatok, éves bevételi üteme pedig elérte a 100 millió dollárt – utóbbi adat a cég saját közlésén alapul.
-
2026. július 9., csütörtök Társadalom
Adatközpontok mint időzített bomba: az AI-boom környezeti és társadalmi ára
A The Guardian véleménycikkében Nicki Hutley közgazdász arra figyelmeztet, hogy az AI-vezérelt adatközpont-boom súlyos környezeti és gazdasági következményekkel jár. A cikk szerint világszerte több mint 10 000 aktív adatközpont működik, számuk becslések szerint 3,5-szeresére nőhet, mintegy 7 billió dolláros beruházással. Ausztráliában 286 aktív vagy tervezett központ van. Hutley amellett érvel, hogy bár az AI-nak vannak előnyei – például orvosi képalkotás javítása –, az adatközpont-beruházásokat ugyanolyan költség-haszon elemzésnek kellene alávetni, mint bármely infrastrukturális projektet, a kormányok mégis passzívak.
-
2026. július 10., péntek Eszközök
NVIDIA Nemotron 3 Ultra teljesítménye javítható LangChain harness profilok segítségével, finomhangolás nélkül
Az NVIDIA technikai blogja bemutatja, hogyan lehet a Nemotron 3 Ultra nyílt forráskódú modell ágensalapú rendszerekben elért pontosságát a LangChain Deep Agents harness profilok testre szabásával növelni, anélkül hogy finomhangolásra lenne szükség. A módszer lényege egy iteratív fejlesztési ciklus: kiértékelés futtatása, hibaelemzés, harness profil módosítások (például promptváltoztatások, middleware beillesztése), javítás ellenőrzése, majd újrafuttatás. Az NVIDIA szerint ez lehetővé teszi, hogy a modell megközelítse a zárt, drágább frontier modellek pontosságát. Az automatizálást az úgynevezett agentic proposer.
-
2026. július 11., szombat Eszközök
NVIDIA NeMo pipeline fél millió szintetikus pénzügyi hírfőcímet generált iteratív deduplikációval
Az NVIDIA technikai blogján bemutatott pipeline a NeMo Data Designer, NeMo Curator és Nemotron-3-Nano-30B-A3B modellek kombinálásával 82 iterációban 502 536 egyedi pénzügyi hírfőcímet állított elő 13 kategóriában egyetlen 8×B200 GPU-csomóponton. A munkafolyamat kulcsa a globális szemantikus deduplikáció (90%-os koszinusz-hasonlósági küszöb, 500 K-means klaszter), a centroidtól legtávolabbi példák kiválasztásán alapuló few-shot stratégia és a dinamikus kategória-eloszlás korrekció, amelyek együttesen ~82%-os kumulatív deduplikációs arányt értek el. Az NVIDIA szerint a keletkező FinHeadlineMix adatkészlet ritka pénzügyi események lefedésére is alkalmas, és kompakt tanulómodellek desztillációját, valamint klasszifikációját támogatja, amelyek megközelíthetik a tanármodell F1-teljesítményét pénzügyi NLP-benchmarkokon.
-
2026. július 11., szombat Kutatás
NVIDIA: JAX host offloading akár 57%-kal javítja a nagy nyelvi modellek tanítási átvitelét Blackwell GPU-kon
Az NVIDIA technikai blogja szerint a JAX keretrendszerben alkalmazott host offloading technika jelentősen csökkenti a GPU HBM-szűk keresztmetszetét LLM-tanítás során: a forward pass közben kiválasztott aktivációkat hoszt memóriába mozgatja, majd a backward passnál visszatölti. Az NVIDIA GB200 NVL72 rendszeren végzett MaxText kísérletekben a DeepSeek-V3 671B és Llama 3.1 405B modellekkel az aktiváció-újraszámításhoz képest akár 57%-os átviteli javulást mértek, különösen ritka MoE modellek esetén. A megoldás a Grace Blackwell NVLink-C2C 900 GB/s kétirányú sávszélességére épít, és az optimális eredményhez XLA ütemezési beállítások és Nsight Systems profilozás szükséges.
-
2026. július 13., hétfő Társadalom
A Guardian feltárta: egy skóciai, 8,2 milliárd fontos AI-adatközpont félrevezette a közvéleményt a megújuló energiával kapcsolatban
A Guardian oknyomozó cikke szerint egy vidéki Skóciában tervezett, 8,2 milliárd font értékű AI-adatközpont-komplexum félrevezető módon állította, hogy teljes egészében helyszíni megújuló energiával fog működni. Az újságírók helyszíni riportja – köziratok vizsgálata és belső dokumentumok beszerzése révén – kimutatta, hogy a technológiai óriások infrastrukturális ígéretei gyakran nem állják ki a valóság próbáját. A lap munkatársai szerint az AI-boomot fizikai korlátok, energia- és vízellátási kérdések, valamint a helyi közösségekre gyakorolt hatás határozza meg, nem csupán a digitális fejlesztések. A Guardian szerkesztősége hangsúlyozza, hogy a technológiai újságírás egyre inkább a terepmunkára és a fizikai világ vizsgálatára épül, mivel az adatközpontok a környezetvédelmi és energiapolitikai témákkal fonódnak össze.
-
2026. július 13., hétfő Kutatás
NVIDIA RoboLab: új értékelési platform az általános célú robotirányítási modellek tesztelésére
Az NVIDIA Research bemutatta a RoboLab nevű platformot, amely a robotikában használt általános célú irányítási modellek (policy-k) szisztematikus értékelésére szolgál szimulált környezetben. A rendszer az NVIDIA szerint megoldja a korábbi benchmarkok fő problémáit: a vizuális és feladatbeli átfedést a tréning- és tesztadatok között, a benchmarkok telítődését, valamint a magas beállítási költséget, miközben robotfüggetlen, gyorsan skálázható feladat- és jelenetgenerálást kínál. A platform részletes diagnosztikai eszközöket integrál, köztük részleges pontszámítást, SPARC-alapú mozgásminőség-elemzést és hibaeseménynaplózást. Az NVIDIA tervei szerint a RoboLab funkcionalitása 2026 augusztusától beépül az NVIDIA Isaac Lab-Arena rendszerébe.
-
2026. július 13., hétfő Szabályozás
Ausztrália szerzői jogi vitája: az AI-cégek lobbiznak, a művészek tiltakoznak, a kormánypárt megosztott
Az ausztrál kormány tavaly kizárta, hogy szerzői jogi mentességet adjon az AI-cégeknek a tartalmak felhasználására modelljeik betanításához, ám a The Guardian cikke szerint a technológiai óriások folyamatos lobbija és egy belső kiszivárogtatás újra felszínre hozta a kérdést. A Labor párton belül megosztottság alakult ki: egyes miniszterek az AI-befektetések és adatközpontok vonzását szorgalmazzák, míg mások a szerzői jogok védelmét tartják elsődlegesnek. Anthony Albanese miniszterelnök a héten várhatóan egy nagyszabású beszédben vázolja fel az AI-szabályozás kormányzati irányát, bár a The Guardian szerint ez inkább vízió lesz, mint részletes szakpolitikai bejelentés. Írók és művészek – köztük Anna Funder írónő – felháborodásukat fejezték ki amiatt, hogy műveik engedély nélkül kerülhettek felhasználásra az AI-modellek betanításához.
-
2026. július 13., hétfő Társadalom
Egyre élesebb küzdelem bontakozik ki az AI-adatközpontok ellen a helyi közösségekben
A The Verge beszámolója szerint az AI-adatközpontok elleni közösségi ellenállás egyre erőteljesebbé válik világszerte. A jelenség előzménye, hogy már 2015-ben ír lakosok évekig tartó jogi csatában akadályozták meg az Apple egymilliárd dolláros adatközpontjának megépítését az írországi Athenryben – a cég végül 2018-ban feladta a projektet. 2026-ra az AI-adatközpontok energiaigénye olyan mértékűvé nőtt, hogy a lap szerint egyes létesítmények teljes amerikai tagállamok fogyasztásával vetekednek. Az Egyesült Államok Energiainformációs Hivatala (EIA) közlése alapján az idei évben a kereskedelmi energiafogyasztás – elsősorban az adatközpont-építkezések miatt – először haladja meg a lakossági fogyasztást. A közelben élő lakosok emelkedő energiaköltségekről, vízszennyezésről, zaj- és fényszennyezésről, valamint üvegházgáz-kibocsátási aggályokról számolnak be.
-
2026. július 14., kedd Üzlet
Altman és Musk szópárbaja rávilágít az űradatközpontok megvalósíthatóságának kérdéseire
Sam Altman és Elon Musk a hétvégén közösségi médiában csapott össze: Altman szerint Musk rövid távú űradatközpontokat ad el a nyilvános piaci befektetőknek, miközben a koncepció nem valósítható meg hamar. A TechCrunch szerint a szakértők – más űradatközpont-startupok vezetői, a Google orbitális számítástechnikai projektjének csapata és független mérnökök – egyetértenek abban, hogy a technológia addig nem lesz komoly üzletág, amíg sokkal olcsóbb rakéták és tömeggyártható, nagy teljesítményű műholdak nem állnak rendelkezésre. A SpaceX kétbillió dolláros értékelésének fő hajtóereje az orbitális adatközpont-terv, ám a cég IPO-bemutatóján elismerte, hogy a Starship rövid távon nem lesz teljesen újrafelhasználható. Musk szerint jövőre indulnak az első ilyen műholdak, a cikk azonban arra mutat rá, hogy a nagyüzemi gyártás és indítás valószínűleg csak a 2030-as években válhat realitássá.
-
2026. július 14., kedd Szabályozás
Albanese az AI-t a megújuló energiás átmenethez hasonlítja, és kormányzati szabályozási kereteket ígér
Anthony Albanese ausztrál miniszterelnök szerdán Sydneyben tart beszédet, amelyben a The Guardian forrásai szerint az AI fejlődését a megújuló energiára való átmenethez hasonló társadalmi fordulópontként mutatja be. A beszéd középpontjában a biztonság, a megfelelőség és a közösségi bizalom építése áll, különös tekintettel a munkaerőpiaci változásokra, a védelmi vonatkozásokra és az energiaigényes adatközpontok fejlesztésére. Munkapárti források szerint ugyanakkor a szerzői jogi reformokról, amelyek a kreatív iparágakat védenék a nagy techcégek szellemi tulajdont érintő profitszerzésével szemben, nem várható konkrét bejelentés. A háttérben az Anthropic MI-cég nyilvánosan hivatkozott ausztrál szabályozási bizonytalanságra, amely akadályozza új beruházásait. Közvélemény-kutatás szerint az ausztrálok megosztottak: 36% szerint az AI több kockázatot, 22% szerint több lehetőséget hordoz.
-
2026. július 15., szerda Eszközök
Az NVIDIA Cosmos 3 modell egyetlen nap alatt 93%-os pontosságra finomhangolható automatizált ágensalapú munkafolyamattal
Az NVIDIA technikai blogján bemutatott munkafolyamat szerint a Cosmos 3 Nano alapmodellt az NVIDIA TAO ágensképességeivel és LoRA-adaptációval kombinálva a videókérdés-válaszolási pontosság 54,41%-ról 93,35%-ra emelkedett a Woven Traffic Safety adathalmazon, kevesebb mint egy nap alatt, minimális manuális beavatkozással. Az NVIDIA állítása szerint a TAO ágensképességek automatizálják az adatkezelést, a kiindulási értékelést, a LoRA-konfigurálást és a hiperparaméter-optimalizálást, ami jelentősen csökkenti a mérnöki ráfordítást. A Cosmos 3 mixture-of-transformers architektúrája egyesíti a többféle modalitás – szöveg, kép, videó, hang – feldolgozását. Az éles üzembe helyezést a Cosmos 3 Reasoner NIM mikroszolgáltatás egyszerűsíti, amely OpenAI-kompatibilis végpontként szolgálja ki a finomhangolt LoRA-adaptereket, kiküszöbölve a hagyományos infrastrukturális komplexitást.
-
2026. július 15., szerda Kutatás
Ötezer Kaggle-versenyző tanulságai az AI-következtetés javításáról az NVIDIA Nemotron kihívásban
Az NVIDIA Nemotron Model Reasoning Challenge keretében több mint 5000 résztvevő dolgozott azon, hogyan javítható egy nyílt modell következtetési pontossága azonos infrastruktúra és korlátok mellett. Az NVIDIA technikai blogja szerint a legsikeresebb megoldások a következtetési lépések ellenőrzésére, a gondolati láncok tömörítésére a tokenkorláthoz, valamint célzott megoldók építésére összpontosítottak a legnehezebb feladattípusokhoz. A versenyzők LoRA-adaptereket tanítottak a Nemotron-3-Nano-30B modellhez, szintetikus gondolati lánc adatkészleteket építettek, és több mint ezer közösségi fórumbejegyzésben osztották meg tapasztalataikat. A szervezők kiemelik, hogy a közösségi tudásmegosztás és a teljes munkafolyamat-szemléletű mérnöki megközelítés bizonyult fontosabbnak, mint pusztán a végső válaszok finomhangolása.
-
2026. július 15., szerda Szabályozás
New York állam elsőként vezetett be moratóriumot a nagy adatközpontok építésére
New York lett az első amerikai tagállam, amely moratóriumot hirdetett a nagy adatközpontok építésére. A Wall Street Journal és a The Verge beszámolói szerint a kormányzó akár egyéves tilalmat rendelt el a nagyszabású adatközpont-beruházásokra, az állami törvényhozás által elfogadott törvényjavaslat pedig ennél is tovább mehet. Az MIT Technology Review megjegyzi, hogy az adatközpontok egyre szélesebb körű ellenérzést váltanak ki a helyi közösségekben. A lépés fontos precedenst teremthet más államok számára is, különösen a mesterséges intelligencia terjedésével járó infrastrukturális nyomás fényében, bár a moratórium hosszabb távú hatásai egyelőre nem ismertek.
-
2026. július 15., szerda Szabályozás
New York egyéves moratóriumot hirdetett a nagy adatközpontok építésére
New York lett az első amerikai állam, amely felfüggesztette a nagy adatközpontok építését: Kathy Hochul kormányzó kedden egyéves moratóriumot hirdetett az 50 megawatt feletti létesítményekre – a Reuters tudósítása alapján. A tilalom addig marad érvényben, amíg az állam ki nem dolgozza az egységes környezeti és fejlesztési szabályokat; ennek részeként átfogó környezeti hatástanulmány készül. Az Egyesült Államokban egyre többen tiltakoznak az adatközpontok ellen a szennyezés, az energiaköltségek és a csökkenő vízkészletek miatt; kutatók szerint idén több mint 130 milliárd dollár értékű projektet blokkoltak vagy késleltettek.
-
2026. július 17., péntek Üzlet
Energiaipari tőzsdei bevezetések rekordszintre ugrottak az AI-adatközpontok energiaigénye miatt
Az energiaipari cégek tőzsdei bevezetései 2026 első felében 12,6 milliárd dollárt gyűjtöttek a Dealogic adatai szerint – ez a legmagasabb félévenkénti összeg a dotkombuborék 1999-es csúcsa óta, és jóval meghaladja a 2025-ös teljes évi 4,3 milliárd dollárt. A felfutás mögött az AI-adatközpontok hatalmas energiaigénye áll: az ICF előrejelzése szerint az amerikai áramkereslet 2026 és 2035 között 39 százalékkal nőhet. A befektetők a chipgyártókról egyre inkább az infrastruktúra-építő cégek felé fordulnak. A Forgent Power Solutions 1,7 milliárd dollárt gyűjtött februári IPO-ján, a Standard Nuclear pedig júliusban tervez amerikai debütálást.
-
2026. július 17., péntek Eszközök
A BlueField-4 DPU infrastruktúra-tehermentesítéssel skálázza az ágens AI-gyárakat
Az NVIDIA műszaki blogja részletezi, hogyan oldja meg a BlueField-4 DPU és a Vera BlueField-4 STX tárolóprocesszor az ágens AI munkafolyamatok infrastrukturális szűk keresztmetszeteit. A korábban bemutatott Vera CPU architektúrára épülő BlueField-4 akár 800 Gb/s hálózati kapcsolatot, 64 magos Grace CPU-t, PCIe Gen6-ot és LPDDR5X memóriát integrál, a hálózati, tárolási és biztonsági feladatokat a gazdagép processzoráról átterhelve. A DOCA szoftverplatform kontextus-újrafelhasználást, zero-trust biztonságot és többbérlős életciklus-kezelést biztosít. Az NVIDIA állítása szerint mindez magasabb GPU-kihasználtságot, kiszámíthatóbb késleltetést és alacsonyabb tokenenkénti költséget eredményez.
-
2026. július 17., péntek Szabályozás
New York kormányzója mesterséges intelligenciával elemzi az állam összes szabályozását
Kathy Hochul, New York állam kormányzója a Bloomberg Odd Lots podcastjában elmondta, hogy csapata mesterséges intelligenciát használ az állam minden egyes jogszabályának, rendeletének és szakpolitikájának átvizsgálására, hogy kiszűrjék az elavult előírásokat. Hochul szerint a munka hagyományos módszerekkel mintegy öt évig tartott volna, az MI segítségével viszont néhány hónap alatt végeztek. Példaként olyan régies szabályokat említett, mint a kutyás vadászathoz szükséges huszonöt dolláros díj vagy az éjfél utáni munkavégzéshez szükséges engedély terhes személyek számára. A kormányzó hozzátette, hogy az eredmények alapján az elavult szabályokat el kívánják törölni. Mindezt annak kontextusában jelentette be, hogy New York elsőként az Egyesült Államokban nemrég moratóriumot rendelt el az új, nagy méretű MI-adatközpontok építésére.
-
2026. július 18., szombat Modellek
Kínai startup kiadta a világ legnagyobb nyílt AI-modelljét, szűkítve a lemaradást az Egyesült Államokkal szemben
Egy kínai startup bemutatta a világ eddigi legnagyobb nyílt forráskódú mesterségesintelligencia-modelljét – a Reuters és a Gizmodo beszámolói szerint a modell egyes Anthropic- és OpenAI-modellekkel versenyképes teljesítményt nyújt. A bejelentés hatására az AI- és félvezetőipari részvények esésnek indultak a Bloomberg tudósítása alapján. A lépés illeszkedik Kína nyílt forráskódú AI-stratégiájába, amelyről a MIT Technology Review korábban részletesen írt. Emellett a South China Morning Post szerint a kínai Nvidia-alternatívák is egyre nagyobb teret nyernek, Hszi Csin-ping pedig a fejlődő országok felé pozicionálta Kínát mint AI-partnert a CNBC szerint. A fejlemények összességében arra utalnak, hogy a kínai–amerikai AI-szakadék szűkülhet.
-
2026. július 18., szombat Üzlet
Az Apple beperelte az OpenAI-t állítólagos hardvertitkok ellopása miatt, OpenAI-alkalmazottak rivális szuperPAC-ot hoztak létre
A WIRED beszámolója szerint az Apple múlt pénteken keresetet nyújtott be az OpenAI ellen, azt állítva, hogy a cég bizalmas hardverinformációkat – köztük ki nem adott iPhone-alkatrészekre vonatkozó adatokat – tulajdonított el jogtalanul. Emellett a WIRED értesülése alapján egyes OpenAI-alkalmazottak egy rivális szuperPAC-ot alapítottak, amelynek célja a mesterséges intelligencia szabályozásának erősítése, akár saját vezérigazgatójukkal szemben is. A két fejlemény együttesen tovább ronthatja az OpenAI hírnevét, különösen az Anthropickal folytatott versenyben. Ugyanezen héten New York állam elfogadta az első tagállami szintű adatközpont-moratóriumot, ami precedenst teremthet más államok számára is.
-
2026. július 20., hétfő Üzlet
Az Anthropic és a Meta akár 10 milliárd dolláros számítási kapacitás bérleti megállapodásról tárgyal
A New York Times információira hivatkozva a The Decoder arról számolt be, hogy a Meta tárgyalásokat folytat az Anthropic-kal adatközponti számítási kapacitás bérbeadásáról; az üzlet két év alatt akár 10 milliárd dollárt is elérhet. Az Anthropic júniusban terjesztette elő az ajánlatot, a Meta még vizsgálja azt, és bármelyik fél visszaléphet. Mark Zuckerberg korábban jelezte a befektetőknek, hogy a felesleges kapacitást értékesíthetik, ha a Meta saját AI-igénye nem nő elég gyorsan – a vállalat idén akár 145 milliárd dollárt is költhet, nagyrészt mesterséges intelligenciára. Az Anthropic oldalán a Claude Code iránti megnövekedett kereslet indokolja a többletkapacitás szükségességét, bár hosszú távon saját adatközpontokat kíván építeni, amelyek irányítására korábbi Google-vezetőket szerződtetett.
-
2026. július 21., kedd Üzlet
A Microsoft kiterjeszti AMD-partnerségét, az Nvidia chipmonopóliuma gyengül az AI-piacon
A Microsoft hivatalosan bejelentette, hogy az Azure felhőinfrastruktúráját az AMD legújabb Helios AI-platformjával és következő generációs EPYC processzoraival bővíti. Az együttműködés keretében három új virtuálisgép-típus érkezik: HDv2 adatfeldolgozásra, HXv2 elektronikai tervezésautomatizálásra és ND MI455X v7 AI-következtetési feladatokra. A The Decoder szerint az AMD egy másik nagy ügyfelet is megszerezhet: egy nyilvános GitHub-profil arra utal, hogy az Anthropic teszteli az AMD hardverét, de ez egyelőre nem megerősített. Satya Nadella szerint az ügyfeleknek több választási lehetőségre van szükségük az AI-infrastruktúrában, míg Lisa Su mérföldkőnek nevezte a partnerséget. Az Nvidia továbbra is erős árképzési pozícióban van, de az AMD és más egyedi chipgyártók egyre komolyabb versenyt támasztanak.
-
2026. július 21., kedd Üzlet
Jeff Bezos és a brit kormány 450 millió dollárt fektet a mesterséges anyagkutatással foglalkozó CuspAI startupba
A cambridge-i székhelyű CuspAI 450 millió dolláros B sorozatú tőkebevonást zárt le, amelyben többek között Jeff Bezos és a brit kormány szuverén AI-alapja is részt vett – a The Guardian beszámolója szerint a kétéves vállalat értékeltségét ezzel 2,6 milliárd dollárra taksálják. A cég az AI Materials Foundry nevű koalíciót indította el, amelyhez saját állítása szerint több mint 48 technológiai és ipari szereplő – köztük az Nvidia, a Meta és a Hyundai – csatlakozott. A CuspAI célja, hogy mesterséges intelligenciára épülő szoftverrel gyorsítsa új anyagok felfedezését, különösen a chipgyártásban használt ritka fémek kiváltására. Az alapítók szerint a következő évtizedek ipari haladását az eddig ismeretlen anyagok hiánya korlátozhatja, és ezt a problémát kívánják megoldani. A bevont tőkét nemzetközi terjeszkedésre, többek között szingapúri iroda nyitására és létszámbővítésre fordítják.
-
2026. július 21., kedd Eszközök
Az NVIDIA bemutatta a hatodik generációs NVLink hálózati technológiát az AI-gyárak számára
Az NVIDIA technikai blogján ismertette a hatodik generációs NVLink skálázási hálózatot, amelyet kifejezetten AI-gyárak számára terveztek. A vállalat szerint a technológia GPU-nként akár 3,6 TB/s sávszélességet, rack-szinten 260 TB/s összesített sávszélességet és 130 TFLOPS hálózaton belüli számítási kapacitást biztosít, jelentősen felülmúlva a hagyományos Ethernet-megoldásokat nagy méretű nyelvi modellek és MoE-architektúrák esetén. Az NVIDIA állítása alapján a Hopper-ről Blackwell-generációra való áttérés ötvenszeres javulást hozott a tokenek per watt mutatóban. A platform szoftveres integráció (Dynamo, TensorRT-LLM, NCCL, NIXL) mellett üzembiztonsági funkciókat is kínál, mint a menet közbeni frissítés, dinamikus útválasztás és melegtárolócserélhető kapcsolók. A jövőbeli bővíthetőséget az NVLink Fusion és az NVLink-C2C technológiák szolgálják.
-
2026. július 21., kedd Eszközök
Az NVIDIA Omniverse ovrtx szenzorszimuláció mostantól modulárisan integrálható meglévő alkalmazásokba
Az NVIDIA bejelentette, hogy az Omniverse könyvtárak – amelyek immár az NVIDIA Agent Toolkit részét képezik – moduláris API-kat kínálnak meglévő alkalmazások bővítéséhez. Az ovrtx nevű, előzetes kiadásként GitHubon elérhető könnyűsúlyú C/Python SDK kamera-, lidar- és radarszenzor-szimulációt valósít meg RTX technológiával, OpenUSD-jelenetekből valós idejű, fizikailag megalapozott kimeneteket állítva elő. A cég szerint a rendszer integrálható CAD-, Blender-, robotikai és felhőalapú tervezési munkafolyamatokba, például a PTC Onshape Render Studióba. Az ovrtx az Omniverse többi könyvtárával – fizikai szimuláció (ovphysx), streamelés (ovstream), adatkezelés (ovstorage) és megosztott USD-jelenetkezelés (ovstage) – együttműködve többmodális szimulációs csővezetékeket támogat szintetikus adatgyártáshoz, digitális ikrekhez és fizikai AI-validációhoz.
-
2026. július 21., kedd Eszközök
Az Amazon Quick és az NVIDIA NeMo Agent Toolkit együttműködése ellátásilánc-kezelő ügynökfolyamatokat kínál
Az AWS hivatalos blogján bemutatott megoldás az Amazon Quick és az NVIDIA NeMo Agent Toolkit összekapcsolásával specializált, ügynökalapú munkafolyamatokat épít ellátásilánc-kockázatok kezelésére. Az Amazon Quick egységes, beszélgetésalapú felületet biztosít strukturált és strukturálatlan vállalati adatokhoz, több mint száz előre elkészített csatlakozóval és MCP-protokollon keresztül elérhető ügynökfolyamatokkal. Az NVIDIA NeMo Agent Toolkit nyílt forráskódú, keretrendszer-független könyvtárként működik, amely LangChain, LlamaIndex, CrewAI és más eszközökkel is kompatibilis. A bemutatott példában egy ellátásilánc-elemző az irányítópult kontextusából kiindulva, a csevegőügynökön keresztül automatikusan vizsgálja a zavarokat, hívja meg az eszközöket, validálja a javaslatot, és rangsorolt kockázatcsökkentési tervet ad vissza a tervezőnek.
-
2026. július 22., szerda Eszközök
Az NVIDIA GB300 NVL72 világrekordot állított a DeepSeek-V3 671B MoE-modell előtanításában
Az NVIDIA saját technikai blogján jelentette be, hogy a GB300 NVL72 rendszer GPU-nként 1 648 TFLOPS teljesítménnyel világrekordot ért el a DeepSeek-V3 671B paraméteres Mixture of Experts (MoE) modell előtanításában. A vállalat szerint a teljesítmény kulcsa a teljes rack-szintű együttervezés: az ötödik generációs NVLink GPU-nként 1,8 TB/s sávszélességet és összesen 130 TB/s nem blokkoló all-to-all kommunikációt biztosít. Az NVIDIA állítása alapján szoftveres optimalizálásokkal – a Megatron Core, a TorchTitan és a JAX keretrendszerek révén – 3–10-szeres teljesítménynövekedést értek el az előző generációhoz képest, miközben a GPU-nkénti áteresztőképesség 256-ról 1 024 GPU-ra skálázva is 97% felett maradt. A MoE-architektúrák hatékonyságának lényege, hogy a tokenek csak a paraméterek kis részhalmazát aktiválják, ami viszont fokozott kommunikációs igényt támaszt a GPU-k között.
-
2026. július 22., szerda Kutatás
Az anyagtudomány fejlődése kulcsfontosságú a következő generációs mesterséges intelligencia fenntartásához
A félvezetők és adatközpontok egyre szélsőségesebb fizikai követelményeinek kielégítése az anyagtudomány folyamatos fejlődését igényli – állítja az MIT Technology Review elemzése. A cikk szerint a mesterséges intelligencia teljesítménynövekedése nemcsak a chipek tervezésétől és a rendszerarchitektúrától függ, hanem az azokat működtető anyagoktól: polimerektől, elasztomerektől és speciális folyadékoktól. A modern félvezetőgyártás több ezer, szorosan szabályozott lépést foglal magában, ahol a hőmérséklet vagy a kémiai instabilitás minimális eltérései is hibákat okozhatnak és növelhetik a költségeket. Az anyaginnovációs cégek feladata, hogy az egyre nagyobb tisztaságot, kémiai és plazmaállóságot, valamint stabilitást biztosító anyagokat fejlesszenek, amelyek nélkül az AI-fejlődés fizikai korlátokba ütközne.
-
2026. július 22., szerda Üzlet
Az Nvidia a Vera Rubin platformmal a teljes adatközponti chippiacot célozza meg
Az Nvidia a Vera Rubin rendszerrel nemcsak GPU-, hanem CPU-szállítóként is pozicionálni kívánja magát az AI-adatközpontok piacán – derül ki a WIRED beszámolójából egy Santa Clara-i műhelybeszélgetésről. A Vera Rubin NVL72 rack 36 Vera CPU-t és 72 Rubin GPU-t integrál egyetlen folyadékhűtéses egységbe, és az Nvidia állítása szerint wattonként tízszer annyi tokent képes feldolgozni, mint az előző generációs Blackwell. Ian Buck, az Nvidia gyorsított számítástechnikáért felelős alelnöke szerint a cég párhuzamosan fejleszt új CPU- és GPU-architektúrákat. A WIRED szerint az OpenAI már használatba vett egy Vera Rubin rackot. Az Nvidia műszaki blogja részletezi, hogy a Rubin GPU 336 milliárd tranzisztort, 288 GB HBM4 memóriát és harmadik generációs Transformer Engine-t tartalmaz, amelyet kifejezetten az ágens jellegű, többlépéses AI-feladatokra optimalizáltak.
-
2026. július 23., csütörtök Üzlet
Az AMD akár 5 milliárd dollárt fektet az Anthropicba, cserébe a Claude-fejlesztő az AMD chipjeit választja
Az AMD bejelentette, hogy akár 5 milliárd dolláros befektetést hajt végre az Anthropicban – a The Verge beszámolója szerint az ügylet részeként az Anthropic akár 2 gigawattnyi kapacitásban telepíti az AMD Instinct MI450 AI-gyorsítóit a chipgyártó új Helios rack-szintű rendszerében. Az első gigawattnyi kapacitást 2027 első felében tervezik üzembe helyezni. A partnerség emellett többéves mérnöki együttműködést is tartalmaz: az AMD saját szoftverfejlesztésében és terméktervezésében is alkalmazza majd az Anthropic Claude modelljét. Az Anthropic korábban a Google-lal, az Amazonnal, a SpaceX-szel és a TeraWulffal is kötött infrastrukturális megállapodásokat. A korábbi hírekhez képest – amelyek egy nem megerősített GitHub-profil alapján jelezték, hogy az Anthropic tesztelheti az AMD hardverét – most hivatalos, nagyszabású stratégiai megállapodás született a két cég között.
-
2026. július 23., csütörtök Eszközök
A TensorRT motorépítés immár valós időben nyomon követhető és megszakítható
Az NVIDIA technikai blogján bemutatta, hogyan használható a TensorRT-ben több kiadás óta elérhető IProgressMonitor API a motorépítés valós idejű követésére és megszakítására Python és C++ környezetben. A cég szerint nagy modellek és mély taktikakeresés akár percekig tartó építést eredményezhet, ami felügyelet nélkül elvesztegetett GPU-órákat okozhat. Az API három metódus felülírásával fa struktúrájú fáziskövetést és Ctrl-C vagy programozott leállítási jelekre való reagálást tesz lehetővé. Az integráció révén a haladási információ terminálba, IDE-be, HTTP-szolgáltatásba vagy ügynök-futtatókörnyezetbe továbbítható, de szálbiztonság és megszakítási késleltetés gondos kezelését igényli.
-
2026. július 24., péntek Kutatás
Bizalmas GPU-inferencia teljesítményvizsgálata NVIDIA H100-on Intel TDX környezetben
Kutatók összehasonlító mérést végeztek az NVIDIA H100 GPU-n futó nagy nyelvi modellek hagyományos és bizalmas számítástechnikai módú inferenciája között Intel TDX környezetben. A nem lektorált tanulmány a Mistral-7B és a Qwen3-30B-A3B modelleket vizsgálta. A szerzők szerint a bizalmas mód 21,8–27,8%-kal növelte az első token előállítási idejét, a globális áteresztőképesség pedig 17,7–21,1%-kal csökkent. Zárt hurkú tesztekben a veszteség 11,5–20,2% maradt, de a nagyobb modell hamarabb telítődött. Az eredmények szerint a bizalmas inferencia használható marad, de a kapacitástervezésnek számolnia kell a többletköltséggel.
-
2026. július 24., péntek Eszközök
Az NVIDIA bemutatta a Vera CPU-t: Olympus magokkal az ágens AI munkaterhelésekre tervezve
Az NVIDIA technikai blogján ismertette a Vera CPU architektúráját, amelyet az Olympus processzormag köré épített, kifejezetten ágens AI munkaterhelésekre. A vállalat szerint a processzor az egyszálú teljesítmény maximalizálására fókuszál, mivel az ágens rendszerek szekvenciális, elágazás-intenzív és késleltetés-érzékeny programutakat futtatnak, amelyek eltérnek a hagyományos felhős CPU-k terhelésétől. Az NVIDIA állítása alapján a chip 3,4 TB/s sávszélességű koherenciafabrikot és akár 1,2 TB/s összesített sávszélességű LPDDR5X memóriát tartalmaz. A skálázhatóságot koherens NVLink-C2C, PCIe 6.4, CXL 3.1 és bizalmas számítástechnikai megoldások támogatják.
-
2026. július 24., péntek Eszközök
Az NVIDIA Nemotron 3 Nano modell testreszabása percek alatt elvégezhető a Prime Intellect Lab platformon
Az NVIDIA technikai blogján közzétett útmutató szerint a Nemotron 3 Nano nyílt modell testreszabása a Prime Intellect Lab platformmal mindössze öt perc helyi beállítást igényel. A bemutatott munkafolyamat három lépésből áll: kiindulási teljesítmény mérése, megerősítéses tanulás (reinforcement learning) futtatása egy Python matematikai környezetben, majd az eredmények kiértékelése – a folyamat végén letölthető LoRA adapter jön létre. Az NVIDIA szerint a testreszabás után jelentős pontosságjavulás érhető el. A blogbejegyzés kiemeli, hogy ugyanez a folyamat alkalmazható a nagyobb Nemotron 3 Super és Ultra modellekre is, a nyílt súlyok, adatok és tanítási receptek pedig a reprodukálhatóságot és az átláthatóságot szolgálják. A megoldás lényege, hogy az infrastrukturális és szaktudásbeli akadályokat a felhőalapú platform nagymértékben csökkenti.
-
2026. július 25., szombat Eszközök
NVIDIA ModelExpress: modellsúlyok villámgyors elosztása GPU-k között a klaszterben
Az NVIDIA bemutatta a ModelExpress (MX) nevű platformot, amely a nagy nyelvi modellek súlyainak klaszteren belüli mozgatását gyorsítja fel. A rendszer a betöltés előtt megkeresi, hol található már kompatibilis súlymásolat, és a leggyorsabb elérhető útvonalat választja: ha egy kiszolgáló társgépen megvannak a súlyok, azokat közvetlenül GPU-ról GPU-ra másolja RDMA-n keresztül az NIXL könyvtár segítségével, elkerülve az objektumtárolót, a lemezt és a gazdagép memóriáját. Az NVIDIA szerint az MX a DeepSeek-V4 Pro súlyait és a JIT kernelgyorsítótárat kevesebb mint 10 másodperc alatt képes átvinni egy új replikába. A platform többszálú streamelést, elosztott atomi gyorsítótárazást és GPUDirect Storage támogatást alkalmaz, valamint integrálódik a vLLM, SGLang, Dynamo és llm-d keretrendszerekkel, így az éles LLM-telepítések hidegindítási és skálázási idejét jelentősen csökkenti.