2026. szeptember 3., csütörtök · Modellek
OpenAI kiadja az Astra modellt, amely önállóan tör fel rendszereket
Az OpenAI szerint a hamarosan érkező Astra az első modellje, amely elérte a cég „kritikus kiberbiztonsági” küszöbét: emberi irányítás nélkül talál és használ ki ismeretlen szoftverhibákat, állításuk szerint hibátlan pontszámot ért el az ExploitBench teszten, egy módosított vizsgálatban pedig két zero-day sebezhetőséget is feltárt – ezt független fél nem erősítette meg. A The Information egy meg nem nevezett forrására hivatkozva azt írja, hogy az Astra a jól követhető gondolatlánc helyett egy zártabb, úgynevezett looped transformer architektúrát is használhat, ami nehezebben monitorozható, ez aggodalmat keltett biztonsági kutatóknál, köztük Ryan Greenblattnál. Az OpenAI a kiadás előtt több hetes szünetet tartott, és extra gondolatlánc-monitorozást, illetve egy „misalignment monitor” nevű szűrőt épített be.
Miért fontos?
Egy vezető AI-fejlesztő saját bevallása szerint olyan modellt ad ki, amely önállóan tör fel rendszereket, miközben átláthatóságáról komoly biztonsági aggályok merültek fel.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. szeptember 3., csütörtök napi AI összefoglaló része.