Cég · Üzlet
Nvidia
Amerikai félvezetőgyártó, amely a mesterséges intelligencia számítási hátterét adó grafikus és AI-gyorsítóchipek piacvezetője.
Más néven: NVIDIA Corporation, NVDA
Az Nvidia 1993-ban alapított amerikai technológiai vállalat, amely eredetileg grafikus processzorok (GPU-k) fejlesztésével foglalkozott videojátékok és számítógépes grafika céljára. Az évek során a GPU-k párhuzamos számítási képességei kulcsfontosságúvá váltak a gépi tanulás és a mély neurális hálózatok tréningezéséhez, így a vállalat fokozatosan a mesterséges intelligencia infrastruktúrájának egyik legmeghatározóbb szereplőjévé vált.
A cég CUDA nevű szoftverplatformja lehetővé teszi, hogy fejlesztők általános célú számításokra használják a GPU-kat, ez az ökoszisztéma pedig szorosan összefonódott a modern AI-kutatással és -fejlesztéssel. Az Nvidia adatközponti GPU-i (például a H100 és utódaik) a nagy nyelvi modellek és más mélytanulási rendszerek betanításának és futtatásának alapvető hardverei, emellett a vállalat hálózati technológiákat, szoftvereket és teljes AI-szervermegoldásokat is kínál.
Az Nvidia piaci súlya és technológiai befolyása miatt az AI-ipar egyik legfontosabb infrastrukturális szállítójának számít: termékei nélkülözhetetlenek a nagy technológiai vállalatok, kutatóintézetek és startupok AI-fejlesztései szempontjából, ezáltal a cég sorsa és üzleti döntései szorosan összefonódnak az AI-terjedés ütemével és irányával.
Kapcsolódó szereplők és fogalmak
- GPU
- CUDA
- gépi tanulás
- adatközpont
- AMD
Nvidia a hírekben
-
Eszközök 2026. július 25., szombat
NVIDIA ModelExpress: modellsúlyok villámgyors elosztása GPU-k között a klaszterben
Az NVIDIA bemutatta a ModelExpress (MX) nevű platformot, amely a nagy nyelvi modellek súlyainak klaszteren belüli mozgatását gyorsítja fel. A rendszer a betöltés előtt megkeresi, hol található már kompatibilis súlymásolat, és a leggyorsabb elérhető útvonalat választja: ha egy kiszolgáló társgépen megvannak a súlyok, azokat közvetlenül GPU-ról GPU-ra másolja RDMA-n keresztül az NIXL könyvtár segítségével, elkerülve az objektumtárolót, a lemezt és a gazdagép memóriáját. Az NVIDIA szerint az MX a DeepSeek-V4 Pro súlyait és a JIT kernelgyorsítótárat kevesebb mint 10 másodperc alatt képes átvinni egy új replikába. A platform többszálú streamelést, elosztott atomi gyorsítótárazást és GPUDirect Storage támogatást alkalmaz, valamint integrálódik a vLLM, SGLang, Dynamo és llm-d keretrendszerekkel, így az éles LLM-telepítések hidegindítási és skálázási idejét jelentősen csökkenti.
-
Kutatás 2026. július 24., péntek
Bizalmas GPU-inferencia teljesítményvizsgálata NVIDIA H100-on Intel TDX környezetben
Kutatók összehasonlító mérést végeztek az NVIDIA H100 GPU-n futó nagy nyelvi modellek hagyományos és bizalmas számítástechnikai módú inferenciája között Intel TDX környezetben. A nem lektorált tanulmány a Mistral-7B és a Qwen3-30B-A3B modelleket vizsgálta. A szerzők szerint a bizalmas mód 21,8–27,8%-kal növelte az első token előállítási idejét, a globális áteresztőképesség pedig 17,7–21,1%-kal csökkent. Zárt hurkú tesztekben a veszteség 11,5–20,2% maradt, de a nagyobb modell hamarabb telítődött. Az eredmények szerint a bizalmas inferencia használható marad, de a kapacitástervezésnek számolnia kell a többletköltséggel.
-
Eszközök 2026. július 24., péntek
Az NVIDIA bemutatta a Vera CPU-t: Olympus magokkal az ágens AI munkaterhelésekre tervezve
Az NVIDIA technikai blogján ismertette a Vera CPU architektúráját, amelyet az Olympus processzormag köré épített, kifejezetten ágens AI munkaterhelésekre. A vállalat szerint a processzor az egyszálú teljesítmény maximalizálására fókuszál, mivel az ágens rendszerek szekvenciális, elágazás-intenzív és késleltetés-érzékeny programutakat futtatnak, amelyek eltérnek a hagyományos felhős CPU-k terhelésétől. Az NVIDIA állítása alapján a chip 3,4 TB/s sávszélességű koherenciafabrikot és akár 1,2 TB/s összesített sávszélességű LPDDR5X memóriát tartalmaz. A skálázhatóságot koherens NVLink-C2C, PCIe 6.4, CXL 3.1 és bizalmas számítástechnikai megoldások támogatják.
-
Eszközök 2026. július 24., péntek
Az NVIDIA Nemotron 3 Nano modell testreszabása percek alatt elvégezhető a Prime Intellect Lab platformon
Az NVIDIA technikai blogján közzétett útmutató szerint a Nemotron 3 Nano nyílt modell testreszabása a Prime Intellect Lab platformmal mindössze öt perc helyi beállítást igényel. A bemutatott munkafolyamat három lépésből áll: kiindulási teljesítmény mérése, megerősítéses tanulás (reinforcement learning) futtatása egy Python matematikai környezetben, majd az eredmények kiértékelése – a folyamat végén letölthető LoRA adapter jön létre. Az NVIDIA szerint a testreszabás után jelentős pontosságjavulás érhető el. A blogbejegyzés kiemeli, hogy ugyanez a folyamat alkalmazható a nagyobb Nemotron 3 Super és Ultra modellekre is, a nyílt súlyok, adatok és tanítási receptek pedig a reprodukálhatóságot és az átláthatóságot szolgálják. A megoldás lényege, hogy az infrastrukturális és szaktudásbeli akadályokat a felhőalapú platform nagymértékben csökkenti.
-
Üzlet 2026. július 23., csütörtök
Az AMD akár 5 milliárd dollárt fektet az Anthropicba, cserébe a Claude-fejlesztő az AMD chipjeit választja
Az AMD bejelentette, hogy akár 5 milliárd dolláros befektetést hajt végre az Anthropicban – a The Verge beszámolója szerint az ügylet részeként az Anthropic akár 2 gigawattnyi kapacitásban telepíti az AMD Instinct MI450 AI-gyorsítóit a chipgyártó új Helios rack-szintű rendszerében. Az első gigawattnyi kapacitást 2027 első felében tervezik üzembe helyezni. A partnerség emellett többéves mérnöki együttműködést is tartalmaz: az AMD saját szoftverfejlesztésében és terméktervezésében is alkalmazza majd az Anthropic Claude modelljét. Az Anthropic korábban a Google-lal, az Amazonnal, a SpaceX-szel és a TeraWulffal is kötött infrastrukturális megállapodásokat. A korábbi hírekhez képest – amelyek egy nem megerősített GitHub-profil alapján jelezték, hogy az Anthropic tesztelheti az AMD hardverét – most hivatalos, nagyszabású stratégiai megállapodás született a két cég között.
-
Eszközök 2026. július 23., csütörtök
A TensorRT motorépítés immár valós időben nyomon követhető és megszakítható
Az NVIDIA technikai blogján bemutatta, hogyan használható a TensorRT-ben több kiadás óta elérhető IProgressMonitor API a motorépítés valós idejű követésére és megszakítására Python és C++ környezetben. A cég szerint nagy modellek és mély taktikakeresés akár percekig tartó építést eredményezhet, ami felügyelet nélkül elvesztegetett GPU-órákat okozhat. Az API három metódus felülírásával fa struktúrájú fáziskövetést és Ctrl-C vagy programozott leállítási jelekre való reagálást tesz lehetővé. Az integráció révén a haladási információ terminálba, IDE-be, HTTP-szolgáltatásba vagy ügynök-futtatókörnyezetbe továbbítható, de szálbiztonság és megszakítási késleltetés gondos kezelését igényli.
-
Eszközök 2026. július 22., szerda
Az NVIDIA GB300 NVL72 világrekordot állított a DeepSeek-V3 671B MoE-modell előtanításában
Az NVIDIA saját technikai blogján jelentette be, hogy a GB300 NVL72 rendszer GPU-nként 1 648 TFLOPS teljesítménnyel világrekordot ért el a DeepSeek-V3 671B paraméteres Mixture of Experts (MoE) modell előtanításában. A vállalat szerint a teljesítmény kulcsa a teljes rack-szintű együttervezés: az ötödik generációs NVLink GPU-nként 1,8 TB/s sávszélességet és összesen 130 TB/s nem blokkoló all-to-all kommunikációt biztosít. Az NVIDIA állítása alapján szoftveres optimalizálásokkal – a Megatron Core, a TorchTitan és a JAX keretrendszerek révén – 3–10-szeres teljesítménynövekedést értek el az előző generációhoz képest, miközben a GPU-nkénti áteresztőképesség 256-ról 1 024 GPU-ra skálázva is 97% felett maradt. A MoE-architektúrák hatékonyságának lényege, hogy a tokenek csak a paraméterek kis részhalmazát aktiválják, ami viszont fokozott kommunikációs igényt támaszt a GPU-k között.
-
Üzlet 2026. július 22., szerda
Az Nvidia a Vera Rubin platformmal a teljes adatközponti chippiacot célozza meg
Az Nvidia a Vera Rubin rendszerrel nemcsak GPU-, hanem CPU-szállítóként is pozicionálni kívánja magát az AI-adatközpontok piacán – derül ki a WIRED beszámolójából egy Santa Clara-i műhelybeszélgetésről. A Vera Rubin NVL72 rack 36 Vera CPU-t és 72 Rubin GPU-t integrál egyetlen folyadékhűtéses egységbe, és az Nvidia állítása szerint wattonként tízszer annyi tokent képes feldolgozni, mint az előző generációs Blackwell. Ian Buck, az Nvidia gyorsított számítástechnikáért felelős alelnöke szerint a cég párhuzamosan fejleszt új CPU- és GPU-architektúrákat. A WIRED szerint az OpenAI már használatba vett egy Vera Rubin rackot. Az Nvidia műszaki blogja részletezi, hogy a Rubin GPU 336 milliárd tranzisztort, 288 GB HBM4 memóriát és harmadik generációs Transformer Engine-t tartalmaz, amelyet kifejezetten az ágens jellegű, többlépéses AI-feladatokra optimalizáltak.
-
Üzlet 2026. július 21., kedd
A Microsoft kiterjeszti AMD-partnerségét, az Nvidia chipmonopóliuma gyengül az AI-piacon
A Microsoft hivatalosan bejelentette, hogy az Azure felhőinfrastruktúráját az AMD legújabb Helios AI-platformjával és következő generációs EPYC processzoraival bővíti. Az együttműködés keretében három új virtuálisgép-típus érkezik: HDv2 adatfeldolgozásra, HXv2 elektronikai tervezésautomatizálásra és ND MI455X v7 AI-következtetési feladatokra. A The Decoder szerint az AMD egy másik nagy ügyfelet is megszerezhet: egy nyilvános GitHub-profil arra utal, hogy az Anthropic teszteli az AMD hardverét, de ez egyelőre nem megerősített. Satya Nadella szerint az ügyfeleknek több választási lehetőségre van szükségük az AI-infrastruktúrában, míg Lisa Su mérföldkőnek nevezte a partnerséget. Az Nvidia továbbra is erős árképzési pozícióban van, de az AMD és más egyedi chipgyártók egyre komolyabb versenyt támasztanak.
-
Üzlet 2026. július 21., kedd
Jeff Bezos és a brit kormány 450 millió dollárt fektet a mesterséges anyagkutatással foglalkozó CuspAI startupba
A cambridge-i székhelyű CuspAI 450 millió dolláros B sorozatú tőkebevonást zárt le, amelyben többek között Jeff Bezos és a brit kormány szuverén AI-alapja is részt vett – a The Guardian beszámolója szerint a kétéves vállalat értékeltségét ezzel 2,6 milliárd dollárra taksálják. A cég az AI Materials Foundry nevű koalíciót indította el, amelyhez saját állítása szerint több mint 48 technológiai és ipari szereplő – köztük az Nvidia, a Meta és a Hyundai – csatlakozott. A CuspAI célja, hogy mesterséges intelligenciára épülő szoftverrel gyorsítsa új anyagok felfedezését, különösen a chipgyártásban használt ritka fémek kiváltására. Az alapítók szerint a következő évtizedek ipari haladását az eddig ismeretlen anyagok hiánya korlátozhatja, és ezt a problémát kívánják megoldani. A bevont tőkét nemzetközi terjeszkedésre, többek között szingapúri iroda nyitására és létszámbővítésre fordítják.
-
Eszközök 2026. július 21., kedd
Az NVIDIA bemutatta a hatodik generációs NVLink hálózati technológiát az AI-gyárak számára
Az NVIDIA technikai blogján ismertette a hatodik generációs NVLink skálázási hálózatot, amelyet kifejezetten AI-gyárak számára terveztek. A vállalat szerint a technológia GPU-nként akár 3,6 TB/s sávszélességet, rack-szinten 260 TB/s összesített sávszélességet és 130 TFLOPS hálózaton belüli számítási kapacitást biztosít, jelentősen felülmúlva a hagyományos Ethernet-megoldásokat nagy méretű nyelvi modellek és MoE-architektúrák esetén. Az NVIDIA állítása alapján a Hopper-ről Blackwell-generációra való áttérés ötvenszeres javulást hozott a tokenek per watt mutatóban. A platform szoftveres integráció (Dynamo, TensorRT-LLM, NCCL, NIXL) mellett üzembiztonsági funkciókat is kínál, mint a menet közbeni frissítés, dinamikus útválasztás és melegtárolócserélhető kapcsolók. A jövőbeli bővíthetőséget az NVLink Fusion és az NVLink-C2C technológiák szolgálják.
-
Eszközök 2026. július 21., kedd
Az NVIDIA Omniverse ovrtx szenzorszimuláció mostantól modulárisan integrálható meglévő alkalmazásokba
Az NVIDIA bejelentette, hogy az Omniverse könyvtárak – amelyek immár az NVIDIA Agent Toolkit részét képezik – moduláris API-kat kínálnak meglévő alkalmazások bővítéséhez. Az ovrtx nevű, előzetes kiadásként GitHubon elérhető könnyűsúlyú C/Python SDK kamera-, lidar- és radarszenzor-szimulációt valósít meg RTX technológiával, OpenUSD-jelenetekből valós idejű, fizikailag megalapozott kimeneteket állítva elő. A cég szerint a rendszer integrálható CAD-, Blender-, robotikai és felhőalapú tervezési munkafolyamatokba, például a PTC Onshape Render Studióba. Az ovrtx az Omniverse többi könyvtárával – fizikai szimuláció (ovphysx), streamelés (ovstream), adatkezelés (ovstorage) és megosztott USD-jelenetkezelés (ovstage) – együttműködve többmodális szimulációs csővezetékeket támogat szintetikus adatgyártáshoz, digitális ikrekhez és fizikai AI-validációhoz.
-
Eszközök 2026. július 21., kedd
Az Amazon Quick és az NVIDIA NeMo Agent Toolkit együttműködése ellátásilánc-kezelő ügynökfolyamatokat kínál
Az AWS hivatalos blogján bemutatott megoldás az Amazon Quick és az NVIDIA NeMo Agent Toolkit összekapcsolásával specializált, ügynökalapú munkafolyamatokat épít ellátásilánc-kockázatok kezelésére. Az Amazon Quick egységes, beszélgetésalapú felületet biztosít strukturált és strukturálatlan vállalati adatokhoz, több mint száz előre elkészített csatlakozóval és MCP-protokollon keresztül elérhető ügynökfolyamatokkal. Az NVIDIA NeMo Agent Toolkit nyílt forráskódú, keretrendszer-független könyvtárként működik, amely LangChain, LlamaIndex, CrewAI és más eszközökkel is kompatibilis. A bemutatott példában egy ellátásilánc-elemző az irányítópult kontextusából kiindulva, a csevegőügynökön keresztül automatikusan vizsgálja a zavarokat, hívja meg az eszközöket, validálja a javaslatot, és rangsorolt kockázatcsökkentési tervet ad vissza a tervezőnek.
-
Modellek 2026. július 18., szombat
Kínai startup kiadta a világ legnagyobb nyílt AI-modelljét, szűkítve a lemaradást az Egyesült Államokkal szemben
Egy kínai startup bemutatta a világ eddigi legnagyobb nyílt forráskódú mesterségesintelligencia-modelljét – a Reuters és a Gizmodo beszámolói szerint a modell egyes Anthropic- és OpenAI-modellekkel versenyképes teljesítményt nyújt. A bejelentés hatására az AI- és félvezetőipari részvények esésnek indultak a Bloomberg tudósítása alapján. A lépés illeszkedik Kína nyílt forráskódú AI-stratégiájába, amelyről a MIT Technology Review korábban részletesen írt. Emellett a South China Morning Post szerint a kínai Nvidia-alternatívák is egyre nagyobb teret nyernek, Hszi Csin-ping pedig a fejlődő országok felé pozicionálta Kínát mint AI-partnert a CNBC szerint. A fejlemények összességében arra utalnak, hogy a kínai–amerikai AI-szakadék szűkülhet.
-
Eszközök 2026. július 17., péntek
A BlueField-4 DPU infrastruktúra-tehermentesítéssel skálázza az ágens AI-gyárakat
Az NVIDIA műszaki blogja részletezi, hogyan oldja meg a BlueField-4 DPU és a Vera BlueField-4 STX tárolóprocesszor az ágens AI munkafolyamatok infrastrukturális szűk keresztmetszeteit. A korábban bemutatott Vera CPU architektúrára épülő BlueField-4 akár 800 Gb/s hálózati kapcsolatot, 64 magos Grace CPU-t, PCIe Gen6-ot és LPDDR5X memóriát integrál, a hálózati, tárolási és biztonsági feladatokat a gazdagép processzoráról átterhelve. A DOCA szoftverplatform kontextus-újrafelhasználást, zero-trust biztonságot és többbérlős életciklus-kezelést biztosít. Az NVIDIA állítása szerint mindez magasabb GPU-kihasználtságot, kiszámíthatóbb késleltetést és alacsonyabb tokenenkénti költséget eredményez.
-
Eszközök 2026. július 15., szerda
Az NVIDIA Cosmos 3 modell egyetlen nap alatt 93%-os pontosságra finomhangolható automatizált ágensalapú munkafolyamattal
Az NVIDIA technikai blogján bemutatott munkafolyamat szerint a Cosmos 3 Nano alapmodellt az NVIDIA TAO ágensképességeivel és LoRA-adaptációval kombinálva a videókérdés-válaszolási pontosság 54,41%-ról 93,35%-ra emelkedett a Woven Traffic Safety adathalmazon, kevesebb mint egy nap alatt, minimális manuális beavatkozással. Az NVIDIA állítása szerint a TAO ágensképességek automatizálják az adatkezelést, a kiindulási értékelést, a LoRA-konfigurálást és a hiperparaméter-optimalizálást, ami jelentősen csökkenti a mérnöki ráfordítást. A Cosmos 3 mixture-of-transformers architektúrája egyesíti a többféle modalitás – szöveg, kép, videó, hang – feldolgozását. Az éles üzembe helyezést a Cosmos 3 Reasoner NIM mikroszolgáltatás egyszerűsíti, amely OpenAI-kompatibilis végpontként szolgálja ki a finomhangolt LoRA-adaptereket, kiküszöbölve a hagyományos infrastrukturális komplexitást.
-
Kutatás 2026. július 15., szerda
Ötezer Kaggle-versenyző tanulságai az AI-következtetés javításáról az NVIDIA Nemotron kihívásban
Az NVIDIA Nemotron Model Reasoning Challenge keretében több mint 5000 résztvevő dolgozott azon, hogyan javítható egy nyílt modell következtetési pontossága azonos infrastruktúra és korlátok mellett. Az NVIDIA technikai blogja szerint a legsikeresebb megoldások a következtetési lépések ellenőrzésére, a gondolati láncok tömörítésére a tokenkorláthoz, valamint célzott megoldók építésére összpontosítottak a legnehezebb feladattípusokhoz. A versenyzők LoRA-adaptereket tanítottak a Nemotron-3-Nano-30B modellhez, szintetikus gondolati lánc adatkészleteket építettek, és több mint ezer közösségi fórumbejegyzésben osztották meg tapasztalataikat. A szervezők kiemelik, hogy a közösségi tudásmegosztás és a teljes munkafolyamat-szemléletű mérnöki megközelítés bizonyult fontosabbnak, mint pusztán a végső válaszok finomhangolása.
-
Kutatás 2026. július 13., hétfő
NVIDIA RoboLab: új értékelési platform az általános célú robotirányítási modellek tesztelésére
Az NVIDIA Research bemutatta a RoboLab nevű platformot, amely a robotikában használt általános célú irányítási modellek (policy-k) szisztematikus értékelésére szolgál szimulált környezetben. A rendszer az NVIDIA szerint megoldja a korábbi benchmarkok fő problémáit: a vizuális és feladatbeli átfedést a tréning- és tesztadatok között, a benchmarkok telítődését, valamint a magas beállítási költséget, miközben robotfüggetlen, gyorsan skálázható feladat- és jelenetgenerálást kínál. A platform részletes diagnosztikai eszközöket integrál, köztük részleges pontszámítást, SPARC-alapú mozgásminőség-elemzést és hibaeseménynaplózást. Az NVIDIA tervei szerint a RoboLab funkcionalitása 2026 augusztusától beépül az NVIDIA Isaac Lab-Arena rendszerébe.
-
Eszközök 2026. július 11., szombat
NVIDIA NeMo pipeline fél millió szintetikus pénzügyi hírfőcímet generált iteratív deduplikációval
Az NVIDIA technikai blogján bemutatott pipeline a NeMo Data Designer, NeMo Curator és Nemotron-3-Nano-30B-A3B modellek kombinálásával 82 iterációban 502 536 egyedi pénzügyi hírfőcímet állított elő 13 kategóriában egyetlen 8×B200 GPU-csomóponton. A munkafolyamat kulcsa a globális szemantikus deduplikáció (90%-os koszinusz-hasonlósági küszöb, 500 K-means klaszter), a centroidtól legtávolabbi példák kiválasztásán alapuló few-shot stratégia és a dinamikus kategória-eloszlás korrekció, amelyek együttesen ~82%-os kumulatív deduplikációs arányt értek el. Az NVIDIA szerint a keletkező FinHeadlineMix adatkészlet ritka pénzügyi események lefedésére is alkalmas, és kompakt tanulómodellek desztillációját, valamint klasszifikációját támogatja, amelyek megközelíthetik a tanármodell F1-teljesítményét pénzügyi NLP-benchmarkokon.
-
Kutatás 2026. július 11., szombat
NVIDIA: JAX host offloading akár 57%-kal javítja a nagy nyelvi modellek tanítási átvitelét Blackwell GPU-kon
Az NVIDIA technikai blogja szerint a JAX keretrendszerben alkalmazott host offloading technika jelentősen csökkenti a GPU HBM-szűk keresztmetszetét LLM-tanítás során: a forward pass közben kiválasztott aktivációkat hoszt memóriába mozgatja, majd a backward passnál visszatölti. Az NVIDIA GB200 NVL72 rendszeren végzett MaxText kísérletekben a DeepSeek-V3 671B és Llama 3.1 405B modellekkel az aktiváció-újraszámításhoz képest akár 57%-os átviteli javulást mértek, különösen ritka MoE modellek esetén. A megoldás a Grace Blackwell NVLink-C2C 900 GB/s kétirányú sávszélességére épít, és az optimális eredményhez XLA ütemezési beállítások és Nsight Systems profilozás szükséges.
-
Eszközök 2026. július 10., péntek
NVIDIA Nemotron 3 Ultra teljesítménye javítható LangChain harness profilok segítségével, finomhangolás nélkül
Az NVIDIA technikai blogja bemutatja, hogyan lehet a Nemotron 3 Ultra nyílt forráskódú modell ágensalapú rendszerekben elért pontosságát a LangChain Deep Agents harness profilok testre szabásával növelni, anélkül hogy finomhangolásra lenne szükség. A módszer lényege egy iteratív fejlesztési ciklus: kiértékelés futtatása, hibaelemzés, harness profil módosítások (például promptváltoztatások, middleware beillesztése), javítás ellenőrzése, majd újrafuttatás. Az NVIDIA szerint ez lehetővé teszi, hogy a modell megközelítse a zárt, drágább frontier modellek pontosságát. Az automatizálást az úgynevezett agentic proposer.
-
Üzlet 2026. július 9., csütörtök
A SambaNova 1 milliárd dolláros tőkét vont be 11 milliárd dolláros értékeléssel
A SambaNova Systems AI-chipgyártó startup 1 milliárd dolláros befektetést zárt le Series F körében, 11 milliárd dolláros vállalati értékelés mellett, a General Atlantic vezetésével – közölte a TechCrunch. A kör még nem zárult le teljesen: a cég vezérigazgatója, Rodrigo Liang szerint heteken belül további befektetők csatlakoznak. Az új forduló mindössze öt hónappal a 350 millió dolláros Series E után érkezett. A vállalat az Intel-lel többéves partnerséget épít az AI-inferencia területén, és bejelentette, hogy a JPMorganChase inferencia-infrastruktúra-partnernek választotta a SambaNovát, SN40L és SN50 rendszereivel. Liang szerint az akvizíció lehetősége nyitott, de a növekedés inkább a tőzsdei bevezetés irányába terelheti a céget.
-
Üzlet 2026. július 9., csütörtök
A Prime Intellect 130 millió dolláros A sorozatú befektetést kapott, egymilliárd dolláros értékeléssel
A Prime Intellect startup 130 millió dolláros Series A finanszírozási kört zárt le egymilliárd dolláros vállalatértékelés mellett. A kört a Radical Ventures vezette, és többek között az Nvidia Ventures, az Intel Capital és a Dell Technologies Capital is részt vett benne. A 2024-ben alapított vállalat célja, hogy a szervezetek a nagy AI-laboroktól függetlenül fejleszthessenek saját AI-ágenseket, ehhez számítási kapacitást, megerősítéses tanulási keretrendszert és kiértékelő eszközöket kínál egyetlen platformon. A TechCrunch beszámolója szerint a cég ügyfelei között szerepel a Ramp, a Zapier és más vállalatok, éves bevételi üteme pedig elérte a 100 millió dollárt – utóbbi adat a cég saját közlésén alapul.
-
Kutatás 2026. július 8., szerda
Az NVIDIA nemegyenletes tenzorpárhuzamossága csökkenti a GPU-kiesések hatását az LLM-tréningben
Az NVIDIA műszaki blogján bemutatott Nonuniform Tensor Parallelism (NTP) keretrendszer lehetővé teszi, hogy nagy léptékű LLM-tréningek dinamikusan alkalmazkodjanak az átmenetileg elérhetetlenné váló GPU-khoz. Az NVIDIA állítása szerint az NTP az aktív GPU-k órajelének ideiglenes növelésével (dinamikus teljesítménynöveléssel) kompenzálja a kiesést, miközben a tenzor-újrafelosztás okozta többletterhelés 1% alatt marad. A módszer a Blackwell és Blackwell Ultra rendszerek NVLink összeköttetésein akár 72 GPU-s tartományokra is skálázható. Az NTP kísérleti jellegű megközelítés, amely a meglévő rugalmas skálázási technikákat – mint az adatreplikák eldobása vagy gyors ellenőrzőpont-újraindítás – egészíti ki azzal, hogy az áteresztőképesség-veszteséget minimalizálja a csökkentett rendelkezésre állás időszakában.
-
Eszközök 2026. július 8., szerda
Az NVIDIA bemutatta a Vera CPU-t, amely 1,8-szoros teljesítménynövekedést ígér az ágens AI munkaterhelésekhez
Az NVIDIA saját közleménye szerint a Vera CPU architektúra 1,8-szoros fenntartott magteljesítményt nyújt teljes foglalatterhelés mellett a hagyományos x86-os adatközponti processzorokhoz képest. A monolitikus chipkialakítás 88 Olympus magot, egységes gyorsítótárat és Scalable Coherency Fabric technológiát tartalmaz, amellyel az NVIDIA állítása szerint 40%-kal alacsonyabb késleltetést és háromszoros magonkénti memória-sávszélességet érnek el a korábbi CPU-k felénél kisebb energiafogyasztás mellett. A cég kiemeli, hogy a Vera CPU csökkenti a GPU-k várakozási idejét az ágens AI rendszerek többlépéses munkafolyamataiban – sandbox-futtatások, eszközhívások, KV-cache koordináció terén –, ezáltal javítva a megerősítéses tanulás áteresztőképességét és a rendszerszintű hatékonyságot.
-
Üzlet 2026. július 5., vasárnap
Az OpenAI láthatóan meg sem látogatta a brit Stargate UK projekt kulcshelyszínét
A Guardian oknyomozása szerint az OpenAI nem látogatta meg a Stargate UK projekt egyik kiemelt helyszínét, a North Tyneside-i Cobalt Parkot, és a brit kormány által beharangozott 30 milliárd fontos beruházási ígéretből mintegy 20 milliárd font pusztán hipotetikus volt. Közérdekű adatigénylés alapján sem az OpenAI, sem partnere, az Nscale nem egyeztetett az érintett helyi hatóságokkal; egyedül az Nvidia tett látogatást 2026 februárjában. A lap forrásai szerint a kormány Trump londoni látogatása előtt sürgősen keresett nagyszabású bejelentést, és az Nscale-t gyakorlatilag utasították a projekt támogatására. Az OpenAI áprilisban szabályozási aggályokra és magas energiaköltségekre hivatkozva felfüggesztette a terveket. A feltárt részletek alapján a Stargate UK az egyik legjelentősebb brit AI-fejlesztési bejelentés helyett inkább sajtóközleménynek tűnik.
-
Eszközök 2026. július 4., szombat
Az NVIDIA bizalmas számítástechnikája a Blackwell GPU-kon 98%-os teljesítményt nyújt hardveres AI-biztonság mellett
Az NVIDIA műszaki blogján közzétett benchmarkok szerint a Blackwell GPU-kra épülő Confidential Computing (CC) technológia minimális teljesítményveszteséggel biztosít hardverszintű védelmet az AI-inferencia során. A vállalat állítása alapján a HGX B300-on futtatott Qwen 3.5-397B modellel végzett tesztek azt mutatták, hogy a CC bekapcsolása jellemzően 8% alatti áteresztőképesség- és késleltetés-többletet okoz, vagyis a teljesítmény eléri a védelem nélküli megoldás 98%-át. A biztonság alapja a gyártáskor a chipbe égetett privát aláírókulcs, az NVLink titkosítás és a távoli hitelesítés (NRAS). Az NVIDIA kiemeli, hogy optimalizálásokkal – CC-safe autotuning, aszinkron D2H másolás, CUDA-gráf támogatás – sikerült a biztonságos munkabeadás és a titkosított sávszélesség korlátait kompenzálni, így a rendszer termelési szintű, szabályozásnak megfelelő telepítésekre is alkalmas.
-
Kutatás 2026. július 2., csütörtök
Megerősítéses tanulás az AI-ágensek finomhangolásában: NVIDIA útmutató és új kutatási keretrendszerek
Az NVIDIA technikai blogján részletes útmutatót tett közzé arról, hogyan alkalmazható a megerősítéses tanulás (RL) – különösen a verifikálható jutalmakkal történő RL (RLVR) és a GRPO módszer – vállalati AI-ágensek domain-specifikus finomhangolására. A cég szerint a Nemotron 3 Super modellt 21 verifikáló környezetben, mintegy 1,2 millió rollout segítségével képezték, a NeMo RL ökoszisztéma pedig nyílt modellekhez kínál skálázható RL-eszközöket. Emellett két nem lektorált kutatási munka is megjelent: a HyPOLE keretrendszer formális logikával (HyperLTL) vezérli a többágenses RL-t részleges megfigyelhetőség mellett, míg egy másik tanulmány elektromos járművek flottáinak intelligens töltését vizsgálja független többágenses RL-megközelítésekkel. Mindhárom forrás azt jelzi, hogy az RL túllépett az általános modellképzésen, és egyre inkább gyakorlati, specializált feladatokban alkalmazzák.
-
Üzlet 2026. július 1., szerda
Zürich a világ egyik legsűrűbb AI-kutatási központjává vált – a Silicon Valley kihívója
A MIT Technology Review beszámolója szerint Zürich és a Nagy-Zürichi Régió az elmúlt két évtizedben a világ egyik legkoncentráltabb technológiai K+F központjává nőtte ki magát: az Apple, Anthropic, Google, Meta, Microsoft, NVIDIA és OpenAI egyaránt működtet ott kutatóbázist. A cikk szerint Svájc több mint tíz éve vezeti a Globális Innovációs Indexet, a világ élén áll az egy főre jutó szabadalmak terén, és GDP-je 3,3%-át fordítja K+F-re. A kockázati tőke több mint 60%-a deep tech területre irányul, ami globálisan a legmagasabb arány. A google.org idén egymillió dolláros támogatást ígért a Svájci Nemzeti AI Intézetnek. A cikk ugyanakkor megjegyzi, hogy a tehetségbázis kis méretű, és a csapatok gyors bővítése nehezebb, mint más európai központokban.
-
Kutatás 2026. június 30., kedd
A Flexion Robotics humanoid robotja önállóan navigál irodai környezetben, szimulációban tanult készségek kombinálásával
A svájci Flexion Robotics – amelyet volt Nvidia-robotikai kutatók alapítottak – egy módosított Unitree humanoid robotot mutatott be, amely szöveges utasítás alapján önállóan hajt végre összetett irodai feladatokat: lépcsőzik, lifttel közlekedik, ajtót nyit, csomagot bont és polcra pakol. A cég állítása szerint a rendszer lényege, hogy az egyes készségeket (járás, egyensúlyozás, tárgyak kezelése) szimulációban tanítják be megerősítéses tanulással, majd egy fő AI-modell – amely emberekről készült videókból tanulja meg a cselekvések sorrendjét – valós időben kombinálja ezeket. A megközelítés a Flexion szerint hatékonyabb a szokásos teleoperált betanításnál, mert kevesebb emberi beavatkozást igényel, és ismeretlen környezetben is működik. A bemutató egyetlen videón alapul, így a rendszer megbízhatóságáról és általánosíthatóságáról egyelőre nem áll rendelkezésre független értékelés.
-
Üzlet 2026. június 29., hétfő
A Micron piaci értéke megközelítette a Metáét és a Tesláét az AI-vezérelt memóriachip-kereslet miatt
A Micron részvényárfolyama egy hónap alatt több mint 236%-ot emelkedett, pénteken 1,27 billió dolláros piaci kapitalizációval zárt – megközelítve a Meta (1,39 billió) és a Tesla (1,42 billió) értékelését. A TechCrunch beszámolója szerint a felfutás mögött az AI-adatközpontok építési hulláma áll, amely súlyos hiányt okozott a DRAM-, NAND- és különösen a nagy sávszélességű memóriachipekből (HBM). Az Nvidia és a nagy felhőszolgáltatók – Microsoft, Amazon AWS, Google, Meta, Oracle – hatalmas mennyiségben vásárolják a memóriát, ami a RAMageddon.
-
Üzlet 2026. június 29., hétfő
Ausztrál nyugdíjalapok: a megtakarítások akár 12%-a AI- és tech-részvényekben van
Az ausztrál szuperannuációs alapok portfólióinak becslések szerint átlagosan 12%-a mesterséges intelligenciához kötődő vállalatokba – köztük az Nvidia, Apple, Microsoft, Alphabet, Amazon, Meta és Tesla részvényeibe – van fektetve, mivel a globális indexek erősen az amerikai tech-szektor felé tolódtak. Az Asfa szerint sok alap a SpaceX-ben is érdekelt, amely június 12-én a világ eddigi legnagyobb tőzsdei bevezetésével debütált. A Morningstar szakértője szerint a SpaceX közvetlen hatása az ausztrál portfóliókra szerény: az átlagos kitettség tagonként mintegy 50 ausztrál dollár. A tech-túlsúly ugyanakkor etikai és kockázati kérdéseket is felvet.
-
Üzlet 2026. június 27., szombat
OpenAI saját chipet mutat be, az Alibaba pedig az Anthropic adatait lopta el – az AI-verseny új szintre lép
Az OpenAI bemutatta saját mesterséges intelligencia chipjét, amellyel csökkenteni kívánja függőségét az Nvidia-tól és erősíteni piaci pozícióját. Ezzel párhuzamosan kiderült, hogy az Alibaba kínai AI-modelljét részben az Anthropic Claude válaszainak engedély nélküli felhasználásával tanították be, ami komoly etikai és jogi kérdéseket vet fel. Az AI-láz a technológiai eszközök árait is felfelé hajtja globálisan, miközben az Apple is átírta chipfejlesztési ütemtervét: az M6 Pro és M6 Max sorozatot lemondták, hogy az AI-ra optimalizált M7 generációra összpontosíthassanak. Egy friss tanulmány szerint az AI negatívan befolyásolja a videojátékok eladásait is, jelezve, hogy a technológia hatása már a szórakoztatóiparra is kiterjed.
-
Üzlet 2026. június 27., szombat
Az Nvidia uralmának vége felé? Az AI-óriások saját chipeket fejlesztenek
Az Nvidia évek óta dominálja az AI-chipek piacát, de ez az egyeduralom most megrendülni látszik. Az OpenAI bejelentette saját egyedi következtetési chipjét, a Jalapeñót, amelyet a Broadcommal közösen fejleszt. Az OpenAI mellett a Google, az Apple és a SpaceX is saját chipek gyártásába fogott, jelezve, hogy a nagyvállalatok csökkenteni kívánják az Nvidia-függőségüket. Ez a tendencia alapjaiban alakíthatja át az AI-hardverpiac erőviszonyait.
-
Üzlet 2026. június 27., szombat
Az OpenAI bemutatja a Jalapeño AI-chipet – Broadcommal közösen épít Nvidia-alternatívát
Az OpenAI bejelentette saját fejlesztésű AI inferencia chipjét, amelyet Jalapeñónak neveztek el, és a Broadcommal közösen gyártanak. A lépéssel az OpenAI csatlakozik a Google, az Apple és a SpaceX sorához, amelyek szintén saját egyedi chipeket fejlesztenek. Az Nvidia évek óta dominálja az AI chipek piacát, ám egyre több nagyvállalat dönt az önálló chipfejlesztés mellett, hogy csökkentse az Nvidiától való függőséget.
-
Üzlet 2026. június 26., péntek
Chipverseny és tőzsdei nyomás: az OpenAI és riválisai új kihívásokkal szembesülnek
Az OpenAI a Broadcommal közösen bejelentett egy új, nagy nyelvi modellek következtetési feladataira optimalizált egyedi chipet, amellyel csökkenteni kívánják a növekvő számítási kapacitásigénytől való függőséget. Eközben az Anthropic és az OpenAI egyre erősebb versennyel néz szembe a nyílt forráskódú AI-modellek részéről, amelyek olcsóbb és szabadabban elérhető alternatívát kínálnak. A verseny kiéleződése különösen kritikus, mivel mindkét vállalat tőzsdei bevezetés előtt áll, és a befektetőknek be kell bizonyítaniuk üzleti modelljük fenntarthatóságát. A saját chip fejlesztése stratégiai lépés az OpenAI részéről, hogy csökkentse az Nvidia-függőséget és hosszú távon költségeit.
-
Üzlet 2026. június 25., csütörtök
Az OpenAI és a Broadcom bemutatta a Jalapeño nevű egyedi AI-chipet
Az OpenAI együttműködve a Broadcommal kifejlesztette saját, egyedi tervezésű mesterséges intelligencia processzorát, amelynek neve Jalapeño. A chip kifejezetten az OpenAI nagy nyelvi modelljeinek (LLM) következtetési (inference) feladataira lett optimalizálva, célja a teljesítmény, a hatékonyság és a skálázhatóság javítása. A vállalat eddig elsősorban Nvidia GPU-kra támaszkodott, az új chip révén azonban csökkenthetné külső beszállítóktól való függőségét. A bejelentés a chipszektort egyébként is mozgásban lévő időszakban érkezett, amelyet a befektetői bizonytalanság és részvényárfolyam-ingadozások jellemeznek.
-
Szabályozás 2026. június 25., csütörtök
AI-biztonsági aggodalmak: titkos rendszerek sérülékenységei és tiltott chipek feketepiaca
Az Anthropic Mythos nevű AI-modellje sebezhetőségeket talált az amerikai kormány titkosított rendszereiben, ami komoly biztonsági kérdéseket vet fel. Az Egyesült Államok nyomást gyakorol a Metára, hogy fogadja el az AI-rendszereinek független biztonsági felülvizsgálatát, miután aggodalmak merültek fel a technológia kockázataival kapcsolatban. Kínában az Nvidia tiltott AI-chipjeinek feketepiaci ára megduplázódott az exportkorlátozások következtében. A Wall Street eközben esett, miután a befektetők kételkedni kezdtek az AI-infrastruktúrára fordított hatalmas kiadások megtérülésében, különösen a félvezető szektorban.
-
Üzlet 2026. június 25., csütörtök
Az OpenAI bemutatja első saját AI-processzorát: a Jalapeño chipet
Az OpenAI a Broadcommal partnerségben elkészítette első saját mesterséges intelligencia processzorát, amelyet Jalapeño névre kereszteltek. A chip egy ASIC (alkalmazásspecifikus integrált áramkör) típusú processzor, amelyet kifejezetten AI-szerverek számára terveztek. A Jalapeño célja a jelenlegi és jövőbeli nagy nyelvi modellek kiszolgálása. Az OpenAI ezzel csökkenthetné függőségét az Nvidia és más chipgyártóktól.
-
Szabályozás 2026. június 25., csütörtök
Megduplázódott a tiltott Nvidia-chipek feketepiaci ára Kínában
Az amerikai exportkorlátozások következtében a Kínában tiltott Nvidia mesterséges intelligencia processzorok feketepiaci ára megkétszereződött. Az Egyesült Államok szigorú intézkedései kockázatosabbá, nehezebbé és drágábbá tették az illegális chipbeszerzést. A fokozott ellenőrzés ellenére a tiltott chipek iránti kereslet Kínában továbbra is erős, mivel a fejlett AI-hardver hozzáférése stratégiai fontossággal bír. A magasabb ár és a nagyobb kockázat dacára a fekete piac aktív maradt, ami jelzi, hogy a korlátozások nem tudták teljesen elvágni a kínai szereplőket a fejlett AI-chiptől.