2026. szeptember 10., csütörtök · Kutatás
Anthropic: a Claude Mythos Preview kiemelkedik exploit-benchmarkokon
Az Anthropic közlése szerint belső teszteken a Claude Mythos Preview képes sebezhetőségeket exploit-alapelemekké alakítani, majd ezeket teljes, végponttól végpontig működő támadási láncokká összefűzni – ez a cég szerint jelentős ugrás a korábbi modellekhez képest, ezért vezették be óvatosan a Project Glasswing program keretében. Ezt a konkrét képességet egyelőre csak az Anthropic saját belső tesztjei támasztják alá, nyilvános benchmark nem. Emellett a cég három friss, kutatói fejlesztésű benchmarkon – ExploitBench, ExploitGym és a saját SCONE-bench – is mérte a modellt, amelyeken a Mythos Preview minden más kiértékelt modellnél jobban teljesített zero-day sebezhetőségek felkutatásában és exploitok elkészítésében. Az Anthropic ebből arra következtet, hogy az exploitfejlesztéshez szükséges szaktudás küszöbe csökkenhet, ahogy hasonló képességű modellek szélesebb körben elérhetővé válnak.
Miért fontos?
Az Anthropic szerint a Claude Mythos Preview három benchmarkon (ExploitBench, ExploitGym, SCONE-bench) minden más modellnél jobban teljesített teljes exploit-láncok előállításában.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. szeptember 10., csütörtök napi AI összefoglaló része.