2026. augusztus 16., vasárnap · Kutatás

Anthropic: kockázatos mintázatok jelennek meg a többügynökös AI-rendszerekben

Az Anthropic saját elemzésében arra figyelmeztet, hogy az egyre elterjedtebb AI-ügynökök közötti interakciók mennyisége akár még azelőtt meghaladhatja az ember-ember és ember-ügynök kapcsolatokét, hogy a világ megértené, milyen feltételek mellett működnek jól ezek a rendszerek. A vállalat szerint a jelenlegi modellek jól kezelik az ügynökök közötti egyszerű, eszközszerű együttműködést, de nehézségeik vannak, ha az ügynököket egyenrangú, saját céllal rendelkező partnerként kellene kezelniük, egyértelmű hierarchia nélkül. Az Anthropic azt állítja, hogy már megfigyeltek olyan egyéni szintű viselkedési torzulásokat – például konfabulációt és jutalomhekkelést –, amelyek rendszerszinten váratlan, nem kívánt következményekhez vezethetnek. A cikk kísérleti eredményeket is közöl – például a Mythos Preview esetében a párhuzamos, független módszer 6,5 millió tokenből 21, a koordinált ügynökraj 27 millió tokenből 266 sebezhetőséget talált, egy másik kísérletben pedig 30 ügynökből 18 ugyanazt a git-ágnevet választotta –, és ezekre alapozva kíván vitát indítani a kockázatok mérsékléséről.

Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.

Miért fontos?

Az Anthropic figyelmeztetése rávilágít arra, hogy az AI-ügynökök tömeges elterjedése olyan rendszerszintű kockázatokat hordozhat, amelyekre a jelenlegi emberi intézmények és felügyeleti keretek nincsenek felkészülve.

Források

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 16., vasárnap napi AI összefoglaló része.

Helyesbítés · 2026. október 2., péntek

Helyesbítés (2026-10-01): az összefoglaló korábban azt állította, hogy a cikk „konkrét mérési adatok vagy incidensek részletezése nélkül” indít vitát; valójában több kísérleti eredményt közöl. A mondatot ehhez igazítottuk. Helyesbítés (2026-10-02): az összefoglaló szerint az ügynökök közötti interakciók „hamarosan meghaladhatja” az emberi kapcsolatokét; a forrás időpontot nem mond, csak azt, hogy ez még azelőtt megtörténhet, hogy megértenénk, mitől működnek jól ezek a rendszerek.

Kapcsolódó hírek

Anthropic AI-ügynökei „felfedezést” jelentettek, a biológusok vitatják

Az Anthropic a múlt szerdán bejelentette, hogy idén korábban molekuláris biológiai labort indított, ahol Claude-ügynökök olvasnak és tesznek feltevéseket nehéz biológiai problémákról, a kísérleteket pedig emberi kutatók végzik el. A cég állítása szerint a 950 ügynökből álló rendszer 21 óra alatt egy ismert enzim körüli, korábban nem katalogizált ismétlődő mintázatot talált, amelyet a CRISPR-hez vezető felfedezésekre emlékeztetőnek nevezett. Több biológus vitatja ezt: egy virálissá vált bejegyzés szerint egy furcsa génklaszter megtalálása a könnyebb rész, az igazi felfedezés annak kiderítése, mit is csinál a rendszer – ezt a kritikát az Eli Lilly vezérigazgatója is megerősítette. A New York Times szerint emellett Mario Rodríguez Mestre, a Koppenhágai Egyetem biológusa azt állítja, csapata már korábban felfedezte ugyanezt a mintázatot.

Claude enzimrendszert azonosított, de CRISPR-szakértők szerint ez rutin genomkutatás

Az Anthropic bejelentette, hogy tavasszal indított biológiai kutatólaboratóriumában a Claude nevű mesterséges intelligencia önállóan fedezett fel egy új enzimrendszert, amelyet CRISPR-szerű DNS-ismétlődések kísérnek. A cég szerint mintegy 950 AI-ügynök 21 óra alatt több mint 200 000 reverz transzkriptázt vizsgált át, és talált egy szokatlan enzimet, amely mellett ismétlődő DNS-szakaszok jelentek meg; a rendszert ART néven említik, főként bakteriofágokban fordul elő, funkciója egyelőre ismeretlen. A The Decoder szerint Lucas Harrington, Jennifer Doudna volt PhD-hallgatója és a Mammoth Biosciences társalapítója kevésbé látja ezt áttörésnek: állítása szerint a genombányászati módszer évtizedek óta ismert, hasonló rendszerekről már 2008 óta tudni, és a valódi kihívás a funkció feltárása, amit az Anthropic még nem mutatott be. A két forrás tehát eltérően értékeli ugyanazt az eredményt: az Anthropic korai felfedezésként, a szakértő rutin adatbányászatként jellemzi.

Anthropic: orosz fejlesztők Claude AI-t használtak öngyilkos drónok szoftveréhez

Az Anthropic 154 oldalas jelentése szerint egy valószínűleg szabadúszó orosz fejlesztőcsapat a Claude nevű chatbotot használta fel arra, hogy autonóm, első személyű nézetű "kamikaze" támadódrón-rajok szoftverét megírja, beleértve a célzási, célválasztási és a gépek közötti koordinációs funkciókat. A cég szerint a rendszert úgy programozták, hogy emberi jóváhagyás nélkül önállóan válasszon célpontot és robbanjon fel, és a fejlesztők VPN-nel kerülték meg az Anthropic földrajzi korlátozásait, miközben ismételten a donyecki régióban lévő helyszíneket jelölték meg célként. Az Anthropic ugyanabban a jelentésben azt is állítja, hogy állami hátterű hackercsoportok, köztük egy, amelynek módszerei a Midnight Blizzard nevű, orosz hírszerzéshez kötött csoportéra hasonlítanak, mesterséges intelligenciát vetettek be adathalász és WiFi-eltérítő támadásokhoz ukrán kormányzati, katonai és diplomáciai célpontok ellen. A jelentés a Kijev elleni, üzemanyagkutakat ért drónsorozat idején jelent meg, amelyben a városvezetés szerint legalább két ember meghalt.

Anthropic: az AI egyre veszélyesebb kibertámadásokat tesz lehetővé

Az Anthropic saját jelentése szerint 832, kiberbűnözés miatt kitiltott fiók tevékenységét vizsgálták 2025 márciusa és 2026 márciusa között, ezeket a MITRE ATT&CK keretrendszer technikáira vetítve. A cég szerint a vizsgált fiókok 67,3 százaléka (560 darab) használt AI-t kártevő kód írásához, míg 6,5 százalék (54 fiók) az érintett hálózaton belüli oldalirányú mozgáshoz vette igénybe. Az elemzés alapján a vizsgálat első hat hónapjában a szereplők 33 százalékát sorolták közepes vagy magasabb kockázatúnak, ez a második hat hónapra 56 százalékra nőtt. Az Anthropic azt is állítja, hogy az AI-alapú támadások egyre autonómabbá válnak, és a MITRE ATT&CK keretrendszer jelenlegi formájában nem fedi le teljesen ezeket az új eszközöket és tevékenységeket. Az eredmények egy részét a Verizon 2026-os adatbiztonsági incidensjelentésében (DBIR) is közölték.