2026. augusztus 26., szerda · Üzlet

OpenAI bemutatta a Jalapeño AI-chip friss teljesítményadatait

Az OpenAI a Hot Chips konferencián mutatta be első saját, Broadcommal fejlesztett inferencia-chipjét, a Jalapeñót, amely kizárólag AI-modellek futtatására szolgál, tanításra nem. A vállalat szerint a chip a SemiAnalysis InferenceX benchmarkján 1,5–1,9-szer több AI-munkát végez wattonként, és 1,7–3,6-szor alacsonyabb végpontok közötti késleltetést ér el, mint az Nvidia GB200/GB300 rendszerei GPT-OSS 120B, DeepSeek R1 és Kimi K2.5 1T modelleken. Az adatokat az OpenAI szolgáltatta, a SemiAnalysis csak néhány futtatást ellenőrzött helyszínen. A SemiAnalysis szerint a méltányosabb összevetés a szintén HBM4-memóriát használó, frissebb Nvidia Vera Rubin platformmal volna, és a Jalapeño ebben az összevetésben is több kimeneti tokent termel megawattonként. OpenAI hardveres alelnöke, Richard Ho szerint a chip idén kis mennyiségben áll üzembe, a nagyobb volumenű gyártás 2027-re várható.

Miért fontos?

Ez az első eset, hogy az OpenAI nyilvános, részben harmadik fél által ellenőrzött mérésekkel állítja szembe saját inferenciachipjét az Nvidia csúcsrendszereivel.

Források

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 26., szerda napi AI összefoglaló része.

Helyesbítés · 2026. október 1., csütörtök

Helyesbítés (2026-10-01): az összefoglaló korábban az OpenAI-nak tulajdonította a Vera Rubin-összevetést („A vállalat szerint a Jalapeño a frissebb Nvidia Vera Rubin platformnál”); a forrásban ez a SemiAnalysis megállapítása.

Kapcsolódó hírek

OpenAI kitart három biztonsági kutató elbocsátása mellett

Az OpenAI pénteki X-bejegyzésében megerősítette, hogy Jasmine Wangot, Tomek Korbakot és Mikita Balesnit azért bocsátotta el, mert megsértették az érzékeny vállalati információk kezelésére vonatkozó szabályokat, és a cég szerint belső vizsgálat a nyílt levélben leírtakon túli szabálysértéseket is feltárt, részletek nélkül. A három kutató csütörtöki nyílt levelében tagadta, hogy bármilyen eljárást megszegtek volna, és azt állította, hogy a hozzáférésük és a külső biztonsági szervezetekkel folytatott együttműködésük addig bevett gyakorlat volt az OpenAI-nál. A kutatók szerint az elbocsátás dermesztő hatással van a kollégákra, akik most bizonytalanok abban, mi számít még elfogadható biztonsági munkának. A TechCrunch szerint a trió azt is tagadta, hogy közük lett volna a The Informationhoz kiszivárgott, az új modellek kevésbé megfigyelhető gondolatmenet-architektúrájára vonatkozó információkhoz.

Amazon is véget vet az adatközpont-megállapodások titkosságának

Az Amazon bejelentette, hogy felhagy a titoktartási megállapodások (NDA) használatával, amikor helyi önkormányzatokkal tárgyal adatközpont-beruházásokról. A lépés a Microsoft korábbi, hasonló döntését követi. A TechCrunch cikke szerint a titkolózás táplálta a közösségi ellenállást az AI-infrastruktúrával szemben, aminek nyomán New Yorktól San Franciscóig több száz moratóriumot javasoltak vagy fogadtak el a helyi hatóságok. A cikk az Equity podcast beszélgetését is idézi, amely azt firtatja, hogy az NDA-k elhagyása valóban megváltoztatja-e az adatközpont-ügyletek lebonyolítását, vagy csak látszatintézkedés. A hír szerint a bizalom felépítése kulcskérdéssé vált a nagy techcégek számára a terjeszkedés folytatásához.

Új IEEE képzési program az AI-chipek tervezéséről

Az IEEE Educational Activities az IEEE Computer Society támogatásával öt kurzusból álló képzési programot indított „AI Processor Architecture, Design Principles, and Performance” néven. A program célja, hogy a mérnökök felkészüljenek az AI-hardverek egyre bonyolultabb tervezési kihívásaira, amelyeket a nagyobb, paraméterdúsabb modellek és az úgynevezett „memória fal” jelensége okoz, vagyis hogy az adatmozgatás a memória és a processzor között egyre inkább korlátozza a teljesítményt. A kurzusok a tervezési alapelvektől a fejlett architektúrákon át a neurális feldolgozó egységek (NPU) ipari alkalmazásáig, valamint az edge, felhő, kvantum és IoT környezetekre szabott tervezésig terjednek. A program hardverépítészeknek, chiptervezőknek, beágyazott rendszerek fejlesztőinek és adatközponti mérnököknek szól, beleértve az AI-chiptervezés felé váltó szakembereket is.

Google univerzális Gemini-ügynököt indít vállalati ügyfeleknek

A Google csütörtöki Gemini at Work eseményén bemutatta új, úgynevezett „univerzális” Gemini-ügynökét, amely a Gemini Enterprise alkalmazáson belül, egyetlen felületről képes feladatokat végrehajtani a Workspace-eszközökben (Gmail, Drive, Docs, Sheets, Calendar), valamint mobilon, asztali gépen és olyan külső appokban is, mint a Slack vagy a Microsoft 365. A vállalat szerint az ügynök felhőben fut, így minden eszközön megőrzi a kontextust, feladatspecifikus al-ügynökökkel dolgozhat, és akár saját „@agents.company.com” céges e-mail-címmel rendelkező „munkatárs-ügynökként” is működhet. A Google Cloud vezérigazgatója, Thomas Kurian szerint az ügynöknek már nem utasításokat, hanem célokat lehet adni, amelyeket önállóan tervez meg és hajt végre. A funkció egyelőre csak vállalati ügyfeleknek érhető el zárt előzetes tesztelésben; a Google korábban, májusban már indított egy fogyasztói Gemini Spark nevű ügynököt is, külön felületen.