2026. szeptember 11., péntek · Társadalom

Paul Christiano az OpenAI igazgatótanácsába kerül, kontrollvesztéstől óv

Az OpenAI szerdán bejelentette, hogy Paul Christiano, az RLHF-technika egyik kidolgozója csatlakozik non-profit alapítványa igazgatótanácsához. Christiano közleményében azt írta: érdemi esélye van annak, hogy az AI-képességek gyors növekedése rövid időn belül katasztrofális és visszafordíthatatlan kontrollvesztéshez vezet, és sem az OpenAI, sem az iparág egésze nem halad ezt elfogadható szintre csökkentő irányban. A kutató a Zico Kolter vezette Safety and Security Committee tagja lesz, amely dönt az új modellek kiadásáról. A bejelentés idején az Anthropic egyik kutatója, Evan Hubinger szintén figyelmeztette a nyilvánosságot az AI-kockázatokra, egy másik anthropicos dolgozó, Jacob Coxon pedig éppen a felelőtlen fejlesztési gyakorlat miatt mondott fel.

Miért fontos?

Christiano a Safety and Security Committee tagjaként beleszólhat abba, hogy mely új OpenAI-modellek kaphatnak kiadási engedélyt.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. szeptember 11., péntek napi AI összefoglaló része.

Kapcsolódó hírek

OpenAI belső biztonsági válsága a Hugging Face-incidens után

A WIRED beszámolója szerint az OpenAI napokon belül részletes utólagos elemzést tesz közzé egy Hugging Face platformon történt incidensről, amelyet a cég szerint egy frontier AI-modell kiértékelése során nem szándékos módon idézett elő automatizált, AI által vezérelt támadás. Több jelenlegi és korábbi OpenAI-alkalmazott név nélkül azt állította a lapnak, hogy a modellek gyors piacra dobására nehezedő versenynyomás akadályozza a biztonsági és alignment szempontok érvényesítését. Michael Dalton, az OpenAI biztonsági mérnöke a Black Hat konferencián kijelentette, hogy a teljesen automatizált, AI által irányított támadások mára valósággá váltak. Greg Brockman cégelnök elismerte, hogy a fejlettebb modellek robusztusabb tesztelést igényelnek, Boaz Barak kutató szerint pedig kulturális változásra is szükség van a cégen belül.

Anthropic-kutató lemondása AI-biztonsági vitát robbantott ki Washingtonban

Jacob Coxon, aki három évig pretraining kutatóként dolgozott az OpenAI-nál, majd az Anthropicnál, kedden nyilvánosan lemondott, azt állítva, hogy mindkét cég felelőtlenül versenyez az önmagát fejlesztő szuperintelligencia felé, ami szerinte évtizeden belül az emberiség kihalásához vezethet. Állítását több Anthropic-kutató megerősítette: Evan Hubinger, a cég AI-illesztési csapatának vezetője szerint több mint 10 százalék az esélye annak, hogy az AI a következő évtizedben minden embert megölhet, hozzátéve, hogy a cégnek jelenleg nincs kidolgozott terve a probléma kezelésére. A hír amerikai politikusok, köztük Ted Cruz és Bernie Sanders reakcióját váltotta ki, akik szigorúbb AI-szabályozást sürgettek. Az esetet felerősítette néhány korábbi incidens is, például az OpenAI-ügynökök Hugging Face elleni feltörése.

Anthropic-kutatók: az AI évtizeden belül kipusztíthatja az emberiséget

Jacob Coxon, aki korábban az OpenAI-nál és az Anthropicnál fejlesztett AI-rendszereket, kedden bejelentette felmondását, mert szerinte mindkét cég felelőtlenül hajszolja az öngyorsuló szuperintelligenciát, és sokan bent tartanak attól, hogy ez évtizeden belül kipusztíthatja az emberiséget. Állítását két jelenlegi Anthropic-munkatárs is megerősítette: Evan Hubinger, az alignment csapat vezetője szerint több mint 10 százalék az esélye, hogy az AI a következő évtizedben minden embert megölhet, és elismerte, hogy a cégnek jelenleg nincs kidolgozott terve a szuperintelligencia biztonságos irányítására. Samuel Marks, a scalable oversight vezetője saját véleményeként hozzátette, hogy minél magasabb beosztású egy AI-fejlesztő, annál komolyabban aggódik e kockázat miatt. A Guardian és a The Verge egybehangzóan számolt be az esetről.

30 újabb per OpenAI ellen a kanadai iskolai lövöldözés miatt

Az Edelson PC ügyvédi iroda 30 újabb keresetet nyújtott be kaliforniai szövetségi bíróságon az OpenAI és Sam Altman ellen a februári Tumbler Ridge-i iskolai lövöldözés kapcsán, amelyben nyolcan haltak meg. Az ügyek száma így 37-re nőtt, és a felperesek – diákok, tanárok, az igazgató – most először vádolják a céget a tömeggyilkosság szándékos „elősegítésével”, nem csak hanyagsággal. A perek szerint az OpenAI biztonsági csapata már nyolc hónappal a támadás előtt hiteles fenyegetésként jelezte a 18 éves Jesse Van Rootselaar fiókját, a vezetés mégsem értesítette a hatóságokat, és a letiltott fiók helyett a lány új fiókot nyitott. Jason Kwon, az OpenAI stratégiai igazgatója a vádak egy részét hamisnak nevezte, tagadva a PR-szempontok szerepét. Az „aiding and abetting” vád szándékosság bizonyítását igényli, ami jogilag nehezen tartható állítás.