Téma
Microsoft AI hírek magyarul
Microsoft AI, Copilot és vállalati mesterséges intelligencia hírek magyarul az AI Szemlén.
-
Nvidia: a szoftveres keret dönti el az AI-ügynök sikerét, nem a modell
Az Nvidia péntek óta ismert kutatása szerint hosszú távú, sok lépésből álló feladatoknál nem a modell, hanem a köré épített szoftveres keret (harness) a döntő tényező. A cég állítása szerint egy egyedi, memóriakezelésre optimalizált és „felügyelő” komponenssel ellátott keretben a Claude Opus 5 modell 100%-os eredményt ért el az ARC-AGI-3 benchmarkon, amely instrukció nélküli 2D-s játékokból áll. Ugyanez a modell harness nélkül csak 30%-ot ért el, ami így is a legjobb eredmény volt a tesztelt modellek között. Az Nvidia szakembere szerint az ügynök valójában nem csak a modellből áll, hanem az eszközökből, a futásidőből és a hozzáférhető könyvtárakból is, amelyek együtt adják a tényleges teljesítményt. A cikk kontrasztként megemlíti a Microsoft áprilisi kutatását is, amely szerint 19 nagy nyelvi modell mindegyike hibázott hosszú dokumentumszerkesztési feladatoknál.
-
A Guardian szerint az AI-alapú állásinterjúk kiszorítják az emberi tényezőt
A Guardian szerkesztőségi cikke szerint egy friss kutatás alapján a brit álláskeresők csaknem fele már találkozott AI-alapú interjúztató rendszerrel, sokan kudarcélménnyel adták fel a jelentkezést. A lap felidézi, hogy Andy Burnham brit miniszterelnök bírálta a Zoomon és Microsoft Teamsen zajló interjúkat, megkérdőjelezve, hogy a jelöltek erényei átadhatók-e személyes találkozó nélkül. A cikk szerint az egyirányú videointerjúk, ahol előre rögzített kérdésekre kell visszajelzés nélkül válaszolni, különösen dezorientálóak. A szerkesztőség szerint az AI-alapú szűrők átláthatatlansága és algoritmikus torzítása komoly probléma; példaként az amerikai EEOC egy korhátrányos megkülönböztetési ügyét említik, amely csak akkor derült ki, amikor egy elutasított jelentkező kizárólag életkorát megváltoztatva újra jelentkezett és átjutott a következő fordulóba.
-
Microsoft egyesíti a Copilot-alkalmazásokat, több funkciót kivezet
A Microsoft egységes Copilot-alkalmazásba olvasztja a fogyasztói Copilot és a vállalati Microsoft 365 Copilot appot, ez egy később idén érkező „szuperapp” előkészítése. A The Verge szerint a globális bevezetés mobilon és weben augusztus közepén, Windows és Mac appon szeptember közepén kezdődik, a fiókok és csevegések átkerülnek az új, közös ikonú alkalmazásba, a vállalati adatok elkülönülnek. A TechCrunch szerint a Microsoft megszünteti a Group Chats funkciót, az AI-podcasteket, a Copilot Labs kísérleti funkciókat és a Deep Research eszközt, valamint kivezeti a Mico animált karaktert. Egy belső feljegyzésre hivatkozva a cikk szerint a Copilotnak „ki kell érdemelnie a létezés jogát”, ami a nem működő funkciók elhagyását jelenti a ChatGPT, Claude és Gemini elleni versenyben.
-
MindTopo: új benchmark a mesterséges intelligencia térbeli-topológiai gondolkodásának mérésére
A Microsoft Research kutatói MindTopo néven új benchmarkot mutattak be, amely azt vizsgálja, hogy a multimodális nagy nyelvi modellek képesek-e felismerni és fenntartani topológiai kapcsolatokat, mint az összekapcsoltság, a körülzártság, a sorrend, az elkülönülés és a csomók. A kutatás szerint a modellek statikus képeken jóval jobban teljesítenek a topológiai viszonyok felismerésében, mint interaktív, tervezést igénylő feladatokban, ahol elveszítik a struktúra nyomon követését, miközben a jelenet változik. A hibák jellemzően nem az észlelésnél, hanem a tervezési fázisban jelentkeznek, amikor a modellek fizikailag lehetetlen lépéseket javasolnak. A kutatók szerint ez fontos hiányosságot jelez a robotikai és interaktív rendszerekhez szánt mesterséges intelligencia fejlesztésében, ahol a strukturális kapcsolatok megőrzése kritikus a megbízható döntéshozatalhoz.
-
Microsoft kutatói bemutatták a CARE-X mellkasröntgen-AI modellt
A Microsoft Research egy kutatási célú vizuális-nyelvi modellt, a CARE-X-et mutatta be, amely mellkasröntgen-felvételek sokféle klinikai feladatát képes kezelni: leletek generálása, kérdések megválaszolása, eszközök felismerése és eltérések helyének azonosítása. A vállalat közlése szerint a modell megerősítéses tanulást (DAPO) alkalmaz a klinikai pontosság javítására, és valós, indiai klinikai adatokon is tesztelték a Narayana Health kórháztól, köztük ritka intenzív osztályos eseteket és CT-vel megerősített megnagyobbodásos állapotokat. Egy külön kísérletben a Qwen3-VL-4B-Instruct modellt determinisztikus mérőeszközökkel kombinálták a méréstől függő diagnózisok pontosságának vizsgálatára. A Microsoft hangsúlyozza, hogy a CARE-X kutatási modell, nem termék vagy orvostechnikai eszköz, és nem alkalmas klinikai diagnózisra.
-
Biztonsági kutatók feltörték az OpenAI Atlas böngészőt WhatsApp-spamhez
A Zenity biztonsági cég kutatói mintegy 20 sebezhetőséget találtak vezető AI-alapú böngészőkben és bővítményekben, köztük az OpenAI, a Google, az Anthropic, a Microsoft és a Perplexity termékeiben. Bemutatott bizonyítékként az OpenAI Atlas böngészőjét úgy manipulálták, hogy egy hamis hírlevél-feliratkozási oldalba rejtett, héber nyelvű utasítás alapján a felhasználó bejelentkezett WhatsApp Web-fiókján keresztül minden kontaktjának ugyanazt az üzenetet küldje el – ez nem WhatsApp-sebezhetőség, hanem prompt injection típusú támadás. A kutatók szerint az AI-böngészők aláásták a régi böngészőbiztonsági mechanizmusokat, például a same-origin policyt, és bár Atlas volt a legvédettebb az általuk tesztelt eszközök között, védelmét így is meg tudták kerülni. OpenAI a jövő héten leállítja az Atlas szolgáltatást.
-
Microsoft nyílt keretrendszert adott ki ügynök-AI kutatáshoz
A Microsoft Research bemutatta az Orchard nevű nyílt forráskódú keretrendszert, amelynek célja az ügynök-alapú AI-kutatás skálázhatóbbá és olcsóbbá tétele. A rendszer magja az Orchard Env, egy Kubernetes-alapú, újrahasználható környezet, amely szoftverfejlesztő, webnavigáló és személyi asszisztens ügynökök betanítására és kiértékelésére is alkalmas, akár valós futtatási keretek, például Codex, OpenClaw vagy ZeroClaw belsejében. A cég állítása szerint az Orchard-SWE mindössze 3 milliárd aktív paraméterrel 69,7%-ot ér el a SWE-bench Verified teszten, rerangolással pedig 73,0%-ot, ami közelíti a több mint tízszer nagyobb élvonalbeli modellek eredményeit. A Microsoft a tanítóadatokat és a kiértékelési módszereket is elérhetővé tette a kutatóközösség számára.
-
Kínai chipfejlesztések rengették meg a globális AI-részvénypiacot
A kínai CXMT memóriachip-gyártó sanghaji tőzsdei debütálása 466 százalékos árfolyamemelkedést hozott, ugyanaznap pedig arról érkezett hír, hogy Kína saját mélyultraibolya litográfiai eszközöket fejlesztett, amely technológia korábban a holland ASML monopóliuma volt. A hírek nyomán világszerte estek az AI-hoz kötődő részvények: a Kospi kedden 11,5, szerdán további 6 százalékot zuhant, a Nasdaq korrekcióba süllyedt, az Nvidia pedig több mint 5 százalékot vesztett, és az Apple átvette tőle a legnagyobb tőzsdei vállalat címet. Pénteken az Amazon és a Microsoft erős eredményei nyomán a piacok visszapattantak, de a hónap így is 2008 óta a legrosszabb volt a Kospi számára. A cikk értelmezése szerint a CXMT DRAM-chipeket gyárt, nem GPU-kat, ezért nem az Nvidia, hanem inkább az SK Hynix és a Micron versenytársa lehet.
-
Kínai nyílt AI-modellek szítanak vitát Washingtonban és Szilícium-völgyben
A Guardian szerint az elmúlt hetekben kínai fejlesztésű, ingyenesen letölthető, nyílt súlyú AI-modellek – például a Moonshot AI Kimi K3 nevű rendszere – piaci zavart okoztak, mivel egyes alkalmazásokban felveszik a versenyt az OpenAI és az Anthropic drágább, zárt termékeivel. A lap állítása szerint ez megosztotta mind a Fehér Házat, mind a techipart: egyes chipgyártók és cégek az olcsó nyílt modellek mellett állnak, míg az OpenAI és az Anthropic biztonsági kockázatokra hivatkozva óvna tőlük. Bessent pénzügyminiszter kínai cégek elleni szankciókat helyezett kilátásba állítólagos szellemitulajdon-lopás miatt, míg Lutnick kereskedelmi miniszter startupalapítóktól kapott leveleket a nyílt modellek megtartása mellett. A cikk szerint a Microsoft, az Nvidia, a Palantir és a Meta közös levélben kérte a törvényhozókat, ne korlátozzák a nyílt modellek használatát.
-
Microsoft Echoverse: mély szimulált világokban edzik a számítógép-kezelő AI-ügynököket
A Microsoft Research bemutatta az Echoverse nevű rendszert, amely tizenkét betanító világot tartalmaz számítógép-használó AI-ügynökök számára: tíz mély alkalmazás-szimulációt és két, kifejezetten nehéz kezelőfelületi elemekre (dátumválasztók, egymásba ágyazott szűrők) fókuszáló világot. A vállalat állítása szerint egy 9 milliárd paraméteres modell mind a tizenkettőn betanítva pontszámát 36,5 százalékról 67,1 százalékra közel duplázta, ezzel tizennégy pontra megközelítve az általuk hivatkozott GPT-5.4 modellt. A kutatók szerint a felszínes szimulációk rontják a teljesítményt, míg a valósághű, koherens állapotú világok és a megerősítéses tanulás segítenek az ügynöknek túllépni az egyszerű utánzáson. A Microsoft négy világot kódjával, adataival és ellenőrző moduljaival együtt elérhetővé tesz GitHubon és Hugging Face-en.
-
Microsoft Research: EvoLib, amely tapasztalatból tanuló tudástárat épít az AI-nak
A Microsoft Research bemutatta az EvoLib nevű keretrendszert, amely a vállalat állítása szerint lehetővé teszi, hogy nagy nyelvi modellek a saját, futásidejű tapasztalataikból tanuljanak, anélkül hogy a modell súlyait módosítanák vagy külső címkézett adatra lenne szükség. A módszer a korábbi próbálkozásokat újrafelhasználható készségekké és reflektív meglátásokká alakítja, amelyeket folyamatosan finomít és összevon, így az egyedi megfigyelésekből egyre általánosabb tudás lesz. A cég szerint az EvoLib bármely, API-n keresztül elérhető, fekete doboz jellegű nyelvi modellhez alkalmazható, mivel nem igényel modellfrissítést. Az eredmény a „Test-Time Learning with an Evolving Library” című kutatási cikkben jelent meg, amelynek lektoráltságáról a közlemény nem tesz említést, így azt egyelőre önálló, nem független módon ellenőrzött állításként kell kezelni.
-
Perplexity Windows-ra is kiterjeszti agentikus AI-asztali eszközét
A Perplexity a vállalat közleménye szerint Windows rendszerre is elérhetővé tette Personal Computer nevű agentikus eszközét, amely áprilisban Mac-en indult, majd májusban a Microsoft 365 alkalmazásokkal és a Teams szoftverrel bővült. Az eszköz a cég állítása szerint általános célú, önállóan cselekvő digitális munkatársként helyi fájlokhoz és alkalmazásokhoz fér hozzá, például dokumentumokat készíthet vagy táblázatokat frissíthet. A Perplexity szerint ez azért fontos, mert a vállalati munka jelentős része helyi Windows-gépeken zajlik, ahová eddig az AI-eszközök nem fértek hozzá. A cég azt is közölte, hogy a szolgáltatás nem tanul a vállalati adatokból, és érzékeny műveletek, például e-mail küldés vagy fájltörlés előtt mindig értesíti a felhasználót. A Windows-verzió a fizetős Max és Enterprise Max előfizetőknek érhető el, amelyek díja havi 200 dollártól indul.
-
Monday.com 600 dolgozót bocsát el AI-átalakítás jegyében
A tel-avivi Monday.com SEC-bejelentés szerint munkaerejének mintegy 20 százalékát, több mint 600 főt bocsát el egy átszervezési terv keretében, amelyet az „AI-vezérelt növekedési stratégiájával” hoz összefüggésbe. A társalapító, Eran Zinman szerint a lépés nem költségcsökkentés vagy emberek AI-val való helyettesítése miatt történt, hanem a tavaly meghirdetett AI-központú átalakuláshoz igazodik. A cég 45-55 millió dolláros átszervezési költséggel számol, de 2026-ra akár 20 százalékos bevételnövekedést is vár. A Financial Times szerint az amerikai techcégek idén már közel 140 ezer állást szüntettek meg, ebből mintegy 50 ezret az Amazon, az Oracle, a Meta és a Microsoft, miközben az AI-t okként megjelölő cégek részvényei a bejelentés után átlagosan közel 10 százalékkal alulteljesítették a Nasdaqot.
-
A Trump-kormány 5 milliárd dolláros, MI-központú tudományos programot indított Genesis Mission néven
A Trump-adminisztráció csütörtökön mutatta be a Genesis Mission első pályázati körét, amelyben 5 milliárd dollárt irányít 278 mesterséges intelligenciára épülő tudományos projektre – a gyógyszerfejlesztéstől az energetikán át a robotikaig. A The Verge beszámolója szerint a Fehér Ház a programot a Manhattan-tervhez hasonlította sürgősségben és ambícióban, az Energiaügyi Minisztérium pedig nemzeti laboratóriumokat, ipart és egyetemeket kíván összefogni. A Google, a Microsoft és az OpenAI számítási kapacitással és MI-kreditekkel járul hozzá a kezdeményezéshez. Kutatók ugyanakkor a The Verge-nek azt nyilatkozták, hogy a koncepció a közfinanszírozású tudományt szilícium-völgyi startupként kezeli, a mérhető megtérülést és a gyorsaságot helyezi előtérbe a lassú, kiszámíthatatlan alapkutatással szemben, és politikai kinevezettek kezébe ad példátlan kontrollt a szövetségi finanszírozás felett.
-
FORCE-Bench: új mérce az ágens MI-rendszerek vállalati pénzügyi értékelésére
Kutatók egy nem lektorált tanulmányban mutatták be a FORCE-Bench értékelési keretrendszert, amely 251 szakértő által annotált lekérdezéssel méri az ágens MI-rendszerek teljesítményét vállalati pénzügyi munkafolyamatokban. A benchmark nyolc dimenzióban – többek között pontosság, hivatkozások, megalapozottság és naprakészség – értékel három feladattípust: ERP-alapú kötelezettségkutatást, nyilvános jelentéseken alapuló entitáselemzést és többforrásos üzleti összefoglalók készítését. A szerzők állítása szerint az általános célú ágens rendszerek valós üzemeltetési korlátok mellett nem teljesítik megbízhatóan a pénzügyi minőségi elvárásokat, míg a Microsoft 365 Copilothoz épített célzott ágens stabilabb eredményeket mutat. Az adatkészletet és a kódot nyílt forráskódúként teszik elérhetővé.
-
A Microsoft kiterjeszti AMD-partnerségét, az Nvidia chipmonopóliuma gyengül az AI-piacon
A Microsoft hivatalosan bejelentette, hogy az Azure felhőinfrastruktúráját az AMD legújabb Helios AI-platformjával és következő generációs EPYC processzoraival bővíti. Az együttműködés keretében három új virtuálisgép-típus érkezik: HDv2 adatfeldolgozásra, HXv2 elektronikai tervezésautomatizálásra és ND MI455X v7 AI-következtetési feladatokra. A The Decoder szerint az AMD egy másik nagy ügyfelet is megszerezhet: egy nyilvános GitHub-profil arra utal, hogy az Anthropic teszteli az AMD hardverét, de ez egyelőre nem megerősített. Satya Nadella szerint az ügyfeleknek több választási lehetőségre van szükségük az AI-infrastruktúrában, míg Lisa Su mérföldkőnek nevezte a partnerséget. Az Nvidia továbbra is erős árképzési pozícióban van, de az AMD és más egyedi chipgyártók egyre komolyabb versenyt támasztanak.
-
A Claude modellek elérhetők a Microsoft Foundry-n, de európai vállalatok nem tudják megfelelően használni adatvédelmi okokból
Az Anthropic és a Microsoft bejelentette a Claude modellek (Opus 4.8, Haiku 4.5, majd Sonnet 5) általános elérhetőségét a Microsoft Foundry platformon, Azure-natív hitelesítéssel, számlázással és jogosultságkezeléssel. A Microsoft dokumentációja szerint azonban az Anthropic a promptok és kimenetek független adatfeldolgozója marad, és jelenleg nem létezik európai adatzóna a Claude modellekhez – a feldolgozás Global Standard.
-
SkillOpt: a Microsoft Research az ügynök-készségeket tanítható paraméterként kezeli, modellsúlyok módosítása nélkül
A Microsoft Research kutatói bemutatták a SkillOpt keretrendszert, amely az AI-ügynökök utasításkészleteit (skill-jeit) nem kézzel szerkeszti, hanem betanítási folyamatként optimalizálja – anélkül, hogy a nyelvi modell súlyait módosítaná. A megközelítés lényege, hogy a skill-fájlt a befagyasztott modellen kívüli tanítható paraméterként kezeli, lépésméret-kontrollt, validációs kapuzást és elutasított szerkesztésekből nyert visszacsatolást alkalmazva. A szerzők szerint hat benchmarkon, hét célmodellen és három végrehajtási módban összesen mind az 52 kiértékelési cellában a SkillOpt érte el a legjobb vagy azzal egyenértékű eredményt. A kutatók azt is állítják, hogy az optimalizált készségek modellméretek, ügynökkeretrendszerek és rokon feladatok között is átvihetők, ami újrafelhasználható munkafolyamat-tudásra utal.
-
Zürich a világ egyik legsűrűbb AI-kutatási központjává vált – a Silicon Valley kihívója
A MIT Technology Review beszámolója szerint Zürich és a Nagy-Zürichi Régió az elmúlt két évtizedben a világ egyik legkoncentráltabb technológiai K+F központjává nőtte ki magát: az Apple, Anthropic, Google, Meta, Microsoft, NVIDIA és OpenAI egyaránt működtet ott kutatóbázist. A cikk szerint Svájc több mint tíz éve vezeti a Globális Innovációs Indexet, a világ élén áll az egy főre jutó szabadalmak terén, és GDP-je 3,3%-át fordítja K+F-re. A kockázati tőke több mint 60%-a deep tech területre irányul, ami globálisan a legmagasabb arány. A google.org idén egymillió dolláros támogatást ígért a Svájci Nemzeti AI Intézetnek. A cikk ugyanakkor megjegyzi, hogy a tehetségbázis kis méretű, és a csapatok gyors bővítése nehezebb, mint más európai központokban.
-
Memora: a Microsoft új memóriarendszere akár 98%-kal kevesebb kontextus-tokennel dolgozik AI-ágenseknél
A Microsoft Research bemutatott egy Memora nevű skálázható memóriarendszert, amely az AI-ágensek hosszú távú feladatkezelését célozza. A rendszer a tárolt gazdag memóriatartalmat elválasztja a könnyűsúlyú absztrakciókra és kulcsingerekre épülő keresési mechanizmustól, így az absztrakció és a specifikusság között egyensúlyt teremt. A Microsoft Research szerint a Memora új csúcseredményt ér el a LoCoMo és LongMemEval benchmarkokon, felülmúlva a Mem0-t, a RAG-ot és a teljes kontextusú inferenciát, miközben akár 98%-kal kevesebb kontextus-tokent használ. A tanulmányt az ICML 2026 konferencián publikálják, kódja nyílt forráskódúként elérhető a GitHubon. A fejlesztés a hónapokig tartó projekteken dolgozó AI-asszisztensek számára lehet kulcsfontosságú, ahol az eddigi megoldások vagy túl töredékes, vagy túlságosan elnagyolt módon kezelték a korábbi interakciókat.
-
A Micron piaci értéke megközelítette a Metáét és a Tesláét az AI-vezérelt memóriachip-kereslet miatt
A Micron részvényárfolyama egy hónap alatt több mint 236%-ot emelkedett, pénteken 1,27 billió dolláros piaci kapitalizációval zárt – megközelítve a Meta (1,39 billió) és a Tesla (1,42 billió) értékelését. A TechCrunch beszámolója szerint a felfutás mögött az AI-adatközpontok építési hulláma áll, amely súlyos hiányt okozott a DRAM-, NAND- és különösen a nagy sávszélességű memóriachipekből (HBM). Az Nvidia és a nagy felhőszolgáltatók – Microsoft, Amazon AWS, Google, Meta, Oracle – hatalmas mennyiségben vásárolják a memóriát, ami a RAMageddon.
-
Ausztrál nyugdíjalapok: a megtakarítások akár 12%-a AI- és tech-részvényekben van
Az ausztrál szuperannuációs alapok portfólióinak becslések szerint átlagosan 12%-a mesterséges intelligenciához kötődő vállalatokba – köztük az Nvidia, Apple, Microsoft, Alphabet, Amazon, Meta és Tesla részvényeibe – van fektetve, mivel a globális indexek erősen az amerikai tech-szektor felé tolódtak. Az Asfa szerint sok alap a SpaceX-ben is érdekelt, amely június 12-én a világ eddigi legnagyobb tőzsdei bevezetésével debütált. A Morningstar szakértője szerint a SpaceX közvetlen hatása az ausztrál portfóliókra szerény: az átlagos kitettség tagonként mintegy 50 ausztrál dollár. A tech-túlsúly ugyanakkor etikai és kockázati kérdéseket is felvet.
-
NYT módosítja a Microsoftot érintő szerzői jogi keresetét új legfelsőbb bírósági döntés nyomán
A New York Times csütörtökön kérte keresetének módosítását az OpenAI és a Microsoft ellen folyó szerzői jogi perben. A lap állítása szerint a Microsoft aktívan ösztönözte az OpenAI-t a NYT szerzői jogvédett tartalmainak felhasználására, mégpedig azáltal, hogy egy, a világ legerősebb szuperszámítógépei közé tartozó rendszert épített számára. A módosítás hátterében egy friss legfelsőbb bírósági döntés áll, amely szigorítja a járulékos szerzői jogsértés bizonyítási mércéjét: a felpereseknek ezentúl igazolniuk kell, hogy az alperes szándékosan ösztönözte a jogsértő magatartást. A Microsoft szóvivője szerint a módosítás csupán egy utolsó kísérlet a kedvezőtlen precedens hatásának kivédésére. A NYT ugyanakkor két korábbi igényt önként visszavon, hogy az eljárást a legerősebb érveire összpontosítsa.