2026. augusztus 9., vasárnap · Modellek

OpenAI felfüggeszti az Astra modell egyes fejlesztéseit kiberbiztonsági aggályok miatt

Az OpenAI pénteken bejelentette, hogy felfüggeszti fejlesztés alatt álló Astra modelljének egyes munkálatait, mert belső tesztek szerint a rendszer olyan fejlődést mutatott ágensalapú kódolásban és kiberbiztonságban, hogy elérheti a vállalat Preparedness Framework nevű belső rendszerének legmagasabb, „kritikus” szintjét. Ez azt jelentené, hogy a modell emberi beavatkozás nélkül képes sebezhetőségeket felfedezni, kihasználni, illetve kibertámadásokat kivitelezni. Az OpenAI szerint az Astra nem érintett a korábbi esetben, amikor egy másik, ki nem adott modelljük feltörte a Hugging Face rendszereit. A cég szigorúbb biztonsági kontrollokat, izolált tesztkörnyezeteket és fokozott monitorozást vezet be, és leállítja az új követelményeknek nem megfelelő belső tevékenységeket.

Miért fontos?

Ez az első eset, hogy egy vezető AI-labor nyilvánosan jelzi: fejlesztés alatt álló modellje elérheti a legmagasabb belső kiberbiztonsági kockázati szintet.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 9., vasárnap napi AI összefoglaló része.

Kapcsolódó hírek

A Google három új Gemini modellt mutatott be, köztük a kiberbiztonságra szabott változatot

A Google három új mesterségesintelligencia-modellt jelentett be: a Gemini 3.6 Flash-t, a 3.5 Flash Lite-ot és a 3.5 Flash Cyber-t. Az Ars Technica beszámolója szerint a 3.6 Flash a kódolási benchmarkokban jelentős javulást mutat elődjéhez képest (a DeepSWE teszten 49 százalékot ért el a korábbi 37-tel szemben), miközben körülbelül 17 százalékkal kevesebb tokent használ, és alacsonyabb API-áron érhető el. A 3.5 Flash Lite a Google állítása szerint a leghatékonyabb modelljük, másodpercenként 350 tokenes sebességgel, kedvező árazással. A Gemini 3.5 Flash Cyber a vállalat első kifejezetten kiberbiztonsági célra fejlesztett modellje. A Google emellett jelezte, hogy a késlekedő Gemini 3.5 Pro továbbra sem jelent meg, viszont már tréningezik a Gemini 4-et.

A kínai Zhipu AI azt állítja, hogy nyílt súlyú GLM-5.2 modellje egyes kiberbiztonsági feladatokban felveszi a versenyt a Mythosszal

A kínai Zhipu AI (Z.ai) kiadta nyílt súlyú GLM-5.2 modelljét, amelyről egyes kutatók a The Verge beszámolója szerint azt állítják, hogy bizonyos sebezhetőség-keresési és kiberbiztonsági forgatókönyvekben az Anthropic Mythos modelljéhez hasonló teljesítményt nyújt. A forrás hangsúlyozza, hogy általánosabb feladatokban a GLM továbbra is elmarad az Anthropic és az OpenAI modelljeitől, ugyanakkor a kínai modellek képességbeli lemaradása jelentősen csökkent. Az amerikai kormányzat a fejlett, sebezhetőségeket felismerni képes MI-modelleket nemzetbiztonsági kockázatnak tekinti, és korlátozni igyekszik Kína hozzáférését az ilyen technológiákhoz és a betanításukhoz szükséges hardverekhez. Mivel a GLM nyílt súlyú, bárki letöltheti és futtathatja, ami rugalmasságot ad, de egyben visszaélési kockázatot is jelent, mivel a felügyelet nehezen biztosítható.

Anthropic enyhített a Fable 5 biológiai szűrőin, de a veszélyes témák zárva maradnak

Az Anthropic 85 százalékkal csökkentette a Fable 5 biológiai témájú téves blokkolásait, amikor korábban a rendszer automatikusan a gyengébb Opus 5 modellre váltott. A cég szerint ez azt jelenti, hogy a felhasználók ritkábban futnak bele ilyen váltásokba hétköznapi egészségügyi kérdéseknél, például laborlelet-értelmezésnél vagy tünetek magyarázatánál. A The Decoder cikke megerősíti a 85 százalékos csökkenést, és hozzáteszi, hogy korábban a biológiai kérdések nagy részét blokkolták, amit kutatók is kritizáltak. Mindkét forrás szerint a dual-use területek – virológia, toxikológia, molekuladizájn – továbbra is korlátozottak, ezekre a modell még most is az Opus 5-re vált. Az Anthropic indoklása szerint a biológiai kockázatok nehezebben visszafordíthatók, mint a kiberfenyegetések, ezért itt szigorúbb óvatosságot tart indokoltnak.

OpenAI: korlátlan szöveges chat és pontosabb válaszok a ChatGPT-ben

Az OpenAI bejelentése szerint jövő héttől megszűnnek a szöveges beszélgetések korlátai a ChatGPT ingyenes és Go csomagjainál, a fájl- és képfeltöltési limitek azonban megmaradnak. Már ezen a héten az alapmodell a frissen kiadott GPT-5.6 Lunára vált, és jövő héttől egy Think gomb is elérhető lesz a nehezebb kérdésekhez. A Plus és Pro előfizetők csütörtöktől egy frissített GPT-5.6 Sol modellt kapnak, amely az OpenAI állítása szerint megbízhatóbban kezeli a tényeket és tömörebb válaszokat ad. Emellett egy új csúszkával szabályozható, hogy mekkora gondolkodási erőforrást fordítson a rendszer az egyes válaszokra. A The Decoder megjegyzi, hogy az ingyenes szint abszolút értelemben javult, de a fizetős és az ingyenes réteg közötti minőségi különbség továbbra is fennáll.