2026. augusztus 19., szerda · Kutatás
Kutatás: az AI-ügynökök még nem elég kreatívak az önfejlesztéshez
Egy Princeton-vezette kutatócsoport (Peter Kirgis és Sayash Kapoor) tanulmánya szerint az AI-ügynökök jelenleg nem képesek valódi, nyílt végű AI-kutatásra, amely a rekurzív önfejlesztés egyik alapfeltétele lehetne. A kutatók egy „shadow evaluation” nevű módszerrel tesztelték az Anthropic Claude Opus 4.8 modelljét két, a NeurIPS 2026 konferenciára beadott, még nem publikált tanulmány kérdésein. Az eredmény szerint az ügynökök meg tudják oldani a szükséges mérnöki feladatokat, de hiányzik belőlük az ítélőképesség és a kreativitás ahhoz, hogy csúcskonferencia-szintű, eredeti tudományos eredményt hozzanak létre. A szerzők szerint ez arra utal, hogy az AI-ipar rekurzív önfejlesztésre vonatkozó ígéretei jelenleg megelőzik a tényleges bizonyítékokat.
Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.
Miért fontos?
Az eredmény konkrét, mérhető bizonyítékot ad arra, hogy az AI gyors, önvezérelt önfejlesztésére vonatkozó ipari ígéretek túlmutatnak a jelenlegi valós teljesítményen. A mögöttes eredményt leíró tanulmány preprint: még nem ment át szakmai bírálaton (peer review).
Források
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. augusztus 19., szerda napi AI összefoglaló része.
Helyesbítés · 2026. október 1., csütörtök
Helyesbítés (2026-09-20): a hírhez utólag hozzáfűztük a nem lektorált (preprint) státusz jelzését, mert a megjelenéskor ez lemaradt. A hír címe, összefoglalója és forrásai változatlanok. Helyesbítés (2026-10-01): a hír alól eltávolítottunk négy arXiv-hivatkozást (2608.13951, 2608.13940, 2608.13926, 2608.13921), mert egyik sem ez a tanulmány. A hír forrása az MIT Technology Review beszámolója.