2026. szeptember 3., csütörtök · Kutatás
Nem lektorált tanulmány: az AI-asszisztensek az erkölcsöt tartják legfontosabbnak
Egy arXiv-on közzétett, még szakmai lektoráláson nem átesett kutatás azt vizsgálta, hogy a nyelvi modellek stabil „ideális önképpel” rendelkeznek-e. A szerzők harminckét, öt korábbi önkép-teszt alapján kiválasztott tulajdonságot hasonlítottak össze páronkénti választásos feladatban, több eltérő keretezésben. A tanulmány szerint a modellek a morális tulajdonságokat rangsorolják a legmagasabbra, ami a fejlesztők beépített értékrendjét (hasznosság, ártalmatlanság, őszinteség) tükrözi, majd a koherens önértés iránti igény következik, míg az önértékelést a legkevésbé preferált tulajdonságnak jelölik. Az eredmény a különböző keretezésekben nagyrészt stabil maradt, kivéve, ha a frissítés célja másik AI-asszisztens volt: ekkor nagyobb hangsúlyt kapott az önértékelés. A szerzők maguk hangsúlyozzák, hogy ez a preprint státuszú, független lektorálás nélküli eredmény.
Miért fontos?
A preprint kutatás módszertani keretet ad az AI-modellek önreflexiójának mérésére, de eredményei még nem mentek át szakmai bírálaton, így óvatosan kezelendők.
Források
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. szeptember 3., csütörtök napi AI összefoglaló része.