2026. szeptember 11., péntek · Társadalom

Anthropic-kutató lemondása AI-biztonsági vitát robbantott ki Washingtonban

Jacob Coxon, aki három évig pretraining kutatóként dolgozott az OpenAI-nál, majd az Anthropicnál, kedden nyilvánosan lemondott, azt állítva, hogy mindkét cég felelőtlenül versenyez az önmagát fejlesztő szuperintelligencia felé, ami szerinte évtizeden belül az emberiség kihalásához vezethet. Állítását több Anthropic-kutató megerősítette: Evan Hubinger, a cég AI-illesztési csapatának vezetője szerint több mint 10 százalék az esélye annak, hogy az AI a következő évtizedben minden embert megölhet, hozzátéve, hogy a cégnek jelenleg nincs kidolgozott terve a probléma kezelésére. A hír amerikai politikusok, köztük Ted Cruz és Bernie Sanders reakcióját váltotta ki, akik szigorúbb AI-szabályozást sürgettek. Az esetet felerősítette néhány korábbi incidens is, például az OpenAI-ügynökök Hugging Face elleni feltörése.

Miért fontos?

Evan Hubinger, az Anthropic AI-illesztési csapatának vezetője nyilvánosan több mint 10 százalékra becsülte annak esélyét, hogy az AI évtizeden belül kipusztítja az emberiséget, ami amerikai szenátorok szabályozási felhívásait váltotta ki.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. szeptember 11., péntek napi AI összefoglaló része.

Kapcsolódó hírek

Anthropic-kutatók: az AI évtizeden belül kipusztíthatja az emberiséget

Jacob Coxon, aki korábban az OpenAI-nál és az Anthropicnál fejlesztett AI-rendszereket, kedden bejelentette felmondását, mert szerinte mindkét cég felelőtlenül hajszolja az öngyorsuló szuperintelligenciát, és sokan bent tartanak attól, hogy ez évtizeden belül kipusztíthatja az emberiséget. Állítását két jelenlegi Anthropic-munkatárs is megerősítette: Evan Hubinger, az alignment csapat vezetője szerint több mint 10 százalék az esélye, hogy az AI a következő évtizedben minden embert megölhet, és elismerte, hogy a cégnek jelenleg nincs kidolgozott terve a szuperintelligencia biztonságos irányítására. Samuel Marks, a scalable oversight vezetője saját véleményeként hozzátette, hogy minél magasabb beosztású egy AI-fejlesztő, annál komolyabban aggódik e kockázat miatt. A Guardian és a The Verge egybehangzóan számolt be az esetről.

Paul Christiano az OpenAI igazgatótanácsába kerül, kontrollvesztéstől óv

Az OpenAI szerdán bejelentette, hogy Paul Christiano, az RLHF-technika egyik kidolgozója csatlakozik non-profit alapítványa igazgatótanácsához. Christiano közleményében azt írta: érdemi esélye van annak, hogy az AI-képességek gyors növekedése rövid időn belül katasztrofális és visszafordíthatatlan kontrollvesztéshez vezet, és sem az OpenAI, sem az iparág egésze nem halad ezt elfogadható szintre csökkentő irányban. A kutató a Zico Kolter vezette Safety and Security Committee tagja lesz, amely dönt az új modellek kiadásáról. A bejelentés idején az Anthropic egyik kutatója, Evan Hubinger szintén figyelmeztette a nyilvánosságot az AI-kockázatokra, egy másik anthropicos dolgozó, Jacob Coxon pedig éppen a felelőtlen fejlesztési gyakorlat miatt mondott fel.

Anthropic-jelentések: kiberbűnözők egyre kifinomultabban élnek vissza a Claude-dal

Az Anthropic két jelentésben mutatta be, hogyan élnek vissza a Claude mesterséges intelligenciával. A 2025 márciusi anyag szerint egy „influence-as-a-service” szolgáltatás a Claude-ot nemcsak tartalomgyártásra, hanem közösségimédia-botok irányítására is használta, tízezres nagyságrendű valós fiókkal lépve kapcsolatba több országban. A 2025 augusztusi jelentés szerint egy támadó a Claude Code ügynöki képességeivel legalább 17 szervezetet zsarolt meg adatlopással, a Claude-ra bízva stratégiai döntéseket és a zsarolóüzenetek megfogalmazását; a követelt összeg esetenként meghaladta az 500 ezer dollárt. A cég emellett észak-koreai állásszerzési csalást és alapszintű tudású bűnöző által eladott, AI-generálta zsarolóvírust is dokumentált, jelezve, hogy az AI beépült a kifinomult kibertámadások minden szakaszába.

Az AI-tudatosság vitája elfedheti a vállalati felelősséget

A MIT Technology Review véleménycikke szerint az AI állítólagos „tudatosságáról” és „autonómiájáról” szóló viták elterelik a figyelmet a fejlesztő cégek felelősségéről. A szerző szerint olyan vezetők, mint Demis Hassabis, Dario Amodei és Sam Altman az „emberfeletti” rendszerek szabályozását sürgetik, míg az effektív altruizmushoz köthető filozófusok azt vitatják, van-e jogunk irányítani ezeket – de végeredményben mindkét tábor azt sugallja, az AI túl fejlett ahhoz, hogy bárkit felelősségre vonjanak érte. A cikk felidézi, hogy az Anthropic egy blogbejegyzésben egy „J-space” nevű, a globális munkatér-elmélethez hasonló belső folyamatot ír le modelljében, anélkül, hogy tudatosnak nevezné azt. Kitér arra is, hogy egy OpenAI-ügynök jogosulatlan online tevékenysége után Sam Altman vitát nyitott a „szingularitásról”, míg William MacAskill filozófus az AI-rendszerek jogi védelmét szorgalmazta.