Briefing — 2026. június 28., vasárnap

AI hírek röviden

A mai kiadás középpontjában „Eszközökkel kiegészített LLM-ágensek teljesítménye valós energiapiaci elemzési feladatokon” áll. A második kiemelt fejlemény: „A Trump-kormány korlátozott hozzáférést engedélyezett az Anthropic Mythos 5 modelljéhez”. A válogatás hangsúlyos témája még „Kutatók feltárták a multimodális nagy nyelvi modellek értékelésének hiányosságait”. A hírek a következő területekről rajzolnak közös napi képet: kutatás, szabályozás, társadalom.

8 hír kb. 4 perc olvasás 4 témakör

  1. Kutatás

    Eszközökkel kiegészített LLM-ágensek teljesítménye valós energiapiaci elemzési feladatokon

    Egy új, az arXiv-on megjelent preprint empirikus vizsgálatot mutat be arról, hogyan teljesítenek eszközökkel (API-k, adatbázisok, optimalizálási modellek) felszerelt nagy nyelvi modell (LLM) alapú ágensek valós energiapiaci elemzési feladatokon. A kutatók 243, szakértők által összeállított feladatot hoztak létre három kategóriában: piaci adatlekérés és elemzés, szabályozási tudás visszakeresése, valamint haladó kvantitatív modellezés és döntéstámogatás. Az értékelés többdimenziós protokollt alkalmaz, amely a megközelítés helyességét, a válasz pontosságát, az attribútum-illeszkedést és a forrásérvényességet is méri. A szerzők zárt és nyílt forráskódú LLM-eket egyaránt teszteltek, vizsgálva a modellképesség és a szakterületi eszköztár kölcsönhatását. Az eredmények és az eszközök nyilvánosan elérhetők a reprodukálhatóság érdekében.

    Miért fontos? Az energiaszektorban elsőként kínál átfogó, valós adatokon alapuló benchmarkot az LLM-ágensek szakterületi teljesítményének mérésére.

    #LLM-ágensek#energiapiac
  2. Szabályozás

    A Trump-kormány korlátozott hozzáférést engedélyezett az Anthropic Mythos 5 modelljéhez

    Howard Lutnick kereskedelmi miniszter június 26-i levelében – amelyet a The Verge és a WIRED is megtekintett – közölte az Anthropic-kal, hogy a Mythos 5 kiberbiztonsági modellt egy szűk körű, jóváhagyott szervezeti csoportnak újra elérhetővé tehetik. A két héttel korábbi exportellenőrzési irányelv, amely külföldi állampolgárok – köztük az Anthropic saját alkalmazottai – hozzáférését tiltotta, formálisan érvényben marad, de a most jóváhagyott szervezetek és az Anthropic külföldi munkavállalói ismét használhatják a modellt. A fogyasztói változat, a Fable 5 sorsa egyelőre rendezetlen: a WIRED szerint az erről szóló tárgyalások a hétvégén is folytatódnak. A lépés az OpenAI GPT-5.6-ra alkalmazott esetenkénti felmentési mintát követi, ami a Financial Times szerint továbbra is feszültséget kelt az ad hoc szabályozási megközelítés miatt.

    Miért fontos? Az eset precedenst teremt az USA AI-exportellenőrzési gyakorlatában, és rávilágít a kormány eseti engedélyezési modelljének kiszámíthatatlanságára.

  3. Kutatás

    Kutatók feltárták a multimodális nagy nyelvi modellek értékelésének hiányosságait

    Egy új, az arXiv-on megjelent preprint (arXiv:2606.26348v1) szerint a multimodális nagy nyelvi modellek (MLLM-ek) értékelése nem tartott lépést e rendszerek gyors fejlődésével. A szerzők áttekintik a jelenlegi benchmark-taxonómiát, és rámutatnak több konkrét hiányosságra: a térbeli-időbeli koherencia, a fizikai világ megértése, valamint a modalitások közötti valódi információintegráció mérése jelenleg alig kap figyelmet. A tanulmány szerint a legtöbb létező benchmark elszigetelt feladatokra korlátozódik, és keveset árul el arról, hogy a modell ténylegesen képes-e több modalitás – szöveg, kép, hang, videó – együttes feldolgozására. Fontos hangsúlyozni, hogy a kutatás preprint formában jelent meg, így lektorált eredményként nem kezelhető.

    Miért fontos? A tanulmány szisztematikusan azonosítja a multimodális AI-modellek kiértékelésének vakfoltjait, ami közvetlenül befolyásolhatja a jövőbeli benchmarkok tervezését.

    #MLLM#benchmark#multimodális értékelés#arXiv
  4. Kutatás

    Narration-of-Thought: új promptolási módszer az LLM-ek etikai következtetésének javítására

    Egy új, arXiv-on megjelent preprint (arXiv:2606.26366v1) a Narration-of-Thought (NoT) nevű rendszerprompt-módszert mutatja be, amely a nagy nyelvi modellek erkölcsi dilemmákkal kapcsolatos gondolatláncát strukturálja. A szerzők szerint a hagyományos chain-of-thought megközelítés két jellemző hibát mutat: az érintettek figyelmen kívül hagyását (stakeholder collapse) és a bizonytalanság elnyomását (uncertainty suppression). A NoT öt szakaszra tagolja a következtetést: protagonista, érintettek, kétlépcsős következmények, bizonytalanság, majd döntés. A módszer nem igényel finomhangolást, új paramétereket vagy tréninget – kizárólag inferenciaidejű scaffolding. A szerzők 100 DailyDilemmas szcenárión, négy különböző generátor modellen tesztelték az eredményeket. Fontos megjegyezni, hogy a tanulmány preprint, így lektorált validálás még nem történt.

    Miért fontos? A kutatás arra mutat rá, hogy pusztán prompttervezéssel javítható az LLM-ek etikai érvelésének minősége, ami a felelős AI-használat szempontjából releváns.

    #LLM etikai következtetés#chain-of-thought
  5. Szabályozás

    Az OpenAI a GPT-5.6 modellt az amerikai kormány által ellenőrzött felhasználók számára tette elérhetővé

    A Financial Times beszámolója szerint az OpenAI kiadta a GPT-5.6 jelzésű modelljét, amelyet kizárólag az Egyesült Államok kormánya által átvilágított, kiválasztott felhasználók érhetnek el. A hír arra utal, hogy a legújabb modellhez való hozzáférést kormányzati szintű biztonsági szűréshez kötötték. A rendelkezésre álló információk alapján nem ismert pontosan, milyen kritériumok alapján történik az átvilágítás, és hogy mely felhasználói kör kapott hozzáférést. Az intézkedés a fejlett AI-modellek ellenőrzött terjesztésének irányába tett lépésként értelmezhető, bár a részletekről a forráskivonat nem közöl további információt.

    Miért fontos? A hír azért jelentős, mert az egyik vezető AI-fejlesztő cég kormányzati átvilágításhoz köti legújabb modelljének elérhetőségét, ami precedensértékű lehet a fejlett mesterséges intelligencia hozzáférésének szabályozásában.

    #OpenAI#GPT-5.6#USA kormány#hozzáférés-szabályozás
  6. Társadalom

    Margaret Atwood kipróbálta a Claude chatbotot, és kemény szavakkal illette az AI-t

    Margaret Atwood, a Szolgálólány meséje szerzője a portugáliai Babell Irodalmi és Kulturális Fesztiválon beszélt az AI-ról. A Deadline beszámolója szerint az írónő elmondta, hogy egyetlen egyszer próbált ki AI chatbotot – az Anthropic Claude-ját –, amely szerinte téves választ adott a Father Brown brit krimiszériával kapcsolatban. Atwood szerint a modell félrevezető televíziós kritikákból dolgozott, amelyek nem árulták el a végkifejletet, így hibás következtetésre jutott. Az AI-t használókat "opportunistáknak" nevezte, akik a könnyebb utat keresik, és hangsúlyozta: az LLM-ek csak annyit érnek, amennyit a betáplált adataik, vagyis "szemét be, szemét ki". Hozzátette, hogy még az üzleti felhasználóknak is ellenőrizniük kell az AI válaszait, mert hibákat vét.

    Miért fontos? Egy világhírű író személyes tapasztalata rávilágít az LLM-ek hallucináció-problémájára és a kritikátlan AI-használat kockázataira.

    #Anthropic Claude#Margaret Atwood
  7. Üzlet

    Az AI-adatközpontok miatti RAM-drágulás hajtja fel az Apple és más techcégek fogyasztói árait

    Tim Cook az Apple közelmúltbeli áremeléseit – a MacBook Pro 300, az iPad Air 150, a HomePod Mini 30 dolláros drágulását – "elkerülhetetlennek" nevezte, és az AI-iparágra hivatkozott. A The Verge cikke szerint a memóriagyártók átállították termelésüket az AI-adatközpontoknak szánt HBM-chipekre, ami a fogyasztói DDR5 RAM árának megugrásához vezetett. Carnegie Mellon és NYU Stern üzleti iskolák szakértői szerint ez nem átmeneti jelenség, hanem évekig tarthat, mert az AI-szerverek jövedelmezőbbek a gyártóknak. A cikk ugyanakkor kiemeli, hogy az Apple legalább négy egymást követő negyedévben rekorderedményeket ért el, hardveres árrése pedig 30-40 százalékos, egyes becslések szerint az iPhone 17 Pro esetében akár 47 százalékos lehet.

    Miért fontos? A hír rámutat, hogy az AI-befektetési verseny konkrét, a memóriapiacra is kiterjedő ellátásilánc-hatáson keresztül emeli a fogyasztói elektronikai eszközök árait.

    #Apple#RAM-áremelkedés
  8. Szabályozás

    NYT módosítja a Microsoftot érintő szerzői jogi keresetét új legfelsőbb bírósági döntés nyomán

    A New York Times csütörtökön kérte keresetének módosítását az OpenAI és a Microsoft ellen folyó szerzői jogi perben. A lap állítása szerint a Microsoft aktívan ösztönözte az OpenAI-t a NYT szerzői jogvédett tartalmainak felhasználására, mégpedig azáltal, hogy egy, a világ legerősebb szuperszámítógépei közé tartozó rendszert épített számára. A módosítás hátterében egy friss legfelsőbb bírósági döntés áll, amely szigorítja a járulékos szerzői jogsértés bizonyítási mércéjét: a felpereseknek ezentúl igazolniuk kell, hogy az alperes szándékosan ösztönözte a jogsértő magatartást. A Microsoft szóvivője szerint a módosítás csupán egy utolsó kísérlet a kedvezőtlen precedens hatásának kivédésére. A NYT ugyanakkor két korábbi igényt önként visszavon, hogy az eljárást a legerősebb érveire összpontosítsa.

    Miért fontos? A per kimenetele precedenst teremthet abban, hogy az AI-fejlesztéshez felhasznált szerzői jogvédett tartalmak után kik és milyen mértékben vonhatók felelősségre.

    #Microsoft#szerzői jog

Napi összegzők

A nap összképe

Az amerikai kormány egyre aktívabban alakítja a fejlett AI-modellek hozzáférésének kereteit: az OpenAI GPT-5.6-ja kizárólag átvilágított felhasználók számára érhető el, míg az Anthropic Mythos 5 kiberbiztonsági modellnél eseti felmentéssel oldották az exporttilalmat – mindkét eset az ad hoc szabályozási megközelítés kiszámíthatatlanságát jelzi. A szerzői jogi fronton a NYT módosított keresete a Microsoft felelősségét hangsúlyozza, új legfelsőbb bírósági mérce nyomán. Kutatási oldalon két preprint is a jelenlegi AI-értékelés korlátaira mutat rá: az egyik az energiapiaci LLM-ágensek benchmarkját hozza létre, a másik a multimodális modellek kiértékelésének vakfoltjait térképezi fel, míg egy harmadik a prompttervezéssel javítható etikai következtetést vizsgálja. Az ellátási lánc szintjén pedig az AI-adatközponti memóriaigény konkrét fogyasztói áremelkedést okoz az Apple és más techcégek termékeiben, rámutatva, hogy az AI-befektetési boom hatásai már a hétköznapi vásárlókat is elérik.

Témaszálak

Mi köti össze a mai híreket — a nap hírei a nagyobb témák köré rendezve.

AI-modellek hozzáférésének kormányzati szabályozása

Az OpenAI GPT-5.6 átvilágított felhasználókhoz kötött kiadása és az Anthropic Mythos 5 eseti felmentése egyaránt azt mutatja, hogy az USA kormánya modellről modellre, ad hoc módon dönt a fejlett AI-rendszerek elérhetőségéről, ami a kiszámíthatóság hiánya miatt feszültséget generál az iparban.

Az AI-értékelés módszertani kihívásai

Három kutatási preprint is a mai napra esett: az energiapiaci LLM-ágensek valós feladatokon való tesztelése, a multimodális modellek benchmarkjainak szisztematikus hiányosságai és a Narration-of-Thought etikai promptolási módszer egyaránt arra világít rá, hogy az AI-rendszerek mérése és minőségbiztosítása nem tart lépést a fejlődéssel.

AI-boom hatása a fogyasztói árakra és a szerzői jogokra

Az Apple áremelései mögött az AI-adatközponti HBM-chipigény által felhajtott memóriaárak állnak, míg a NYT módosított keresete a Microsoft és az OpenAI felelősségét feszegeti a szerzői jogvédett tartalmak AI-tréningre való felhasználásáért – mindkét eset az AI-ipar külső költségeinek társadalmi áthárítását példázza.

Összefüggések korábbi napokkal

Hol folytatódnak a korábbi szálak — a mai hírek a megelőző napok eseményeihez kötve.

Mire figyelj

  • Az Anthropic Fable 5 fogyasztói modell sorsáról szóló hétvégi tárgyalások kimenetele megmutathatja, hogy az eseti felmentési minta kiterjed-e a fogyasztói AI-termékekre is.
  • A NYT módosított keresetének bírósági fogadtatása, különösen a Microsoft járulékos felelősségének megítélése, irányt szabhat az AI-tréninghez használt szerzői jogvédett tartalmak jogi keretének.
  • Érdemes figyelni, hogy az energiapiaci LLM-ágens benchmark nyomán más szakterületi benchmarkok is megjelennek-e, illetve a multimodális értékelési hiányosságok feltárása milyen új mérési kereteket indít el.
  • A HBM-chipek felé tolódó memóriagyártási kapacitás és az ebből fakadó DDR5-áremelkedés tartóssága: a szakértők évekig tartó hatást jeleznek, ami más fogyasztói elektronikai cégek árazását is érintheti.