2026. augusztus 29., szombat · Kutatás
Google DeepMind kriptográfiai duplán vak AI-tesztet indít
A Google DeepMind állítása szerint elindította az első „duplán vak” kiértékelését egy élvonalbeli, saját fejlesztésű AI-modellnek, hogy kiküszöbölje a benchmark-szennyezettséget, azaz amikor a modell már a tanítás során látta a teszt kérdéseit. A cég szerint a pilot projektben a szingapúri AI Safety Institute és más partnerek vesznek részt, egy Gemini Flash Lite modellt titkos benchmarkok ellen tesztelve. A módszer a Google Cloud Confidential Space nevű bizalmas számítási technológiáját használja: kriptográfiai úton biztosítja, hogy az értékelő ne lássa a modell súlyait, a Google pedig ne lássa a teszt kérdéseit. A vállalat szerint korábban ez kompromisszumot igényelt, mivel vagy a tesztkérdéseket kellett átadni a fejlesztőnek, vagy a modellsúlyokat az értékelőnek.
Miért fontos?
A módszer, ha beválik, lehetővé teheti, hogy független szervezetek szigorúan teszteljék a legfejlettebb AI-modelleket adataik vagy szellemi tulajdonuk feladása nélkül.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. augusztus 29., szombat napi AI összefoglaló része.