2026. július 6., hétfő · Kutatás
Az AI-keresőügynökök nem a kereséssel küzdenek, hanem a kétértelmű kérdések felismerésével
A Tencent Hunyuan és a Tsinghua Egyetem kutatói DiscoBench nevű benchmarkot mutattak be, amely azt méri, képesek-e a nyelvi modellek felismerni a lekérdezések kétértelműségét és visszakérdezni ahelyett, hogy hibás feltételezésekkel folytassák a keresést. A 211 feladatot és 463 kétértelmű pontot tartalmazó rendszer négyféle ambiguitást különböztet meg: több entitásra illeszkedő leírás, időszakfüggőség, eltérő értékelési szempontok, illetve ténybeli hiba. A kutatók szerint a keresőügynökök valódi gyengesége nem maga a keresés, hanem hogy a korai félreértelmezés kaszkádszerűen végiggyűrűzik a gondolkodási láncon. A korábbi benchmarkok egyértelmű lekérdezéseket feltételeztek, a DiscoBench viszont valós, hiányos kérdésekre fókuszál.
Miért fontos?
Rámutat, hogy az AI-keresőügynökök legfőbb hiányossága nem a keresés, hanem a kétértelműség felismerése és a visszakérdezés képessége.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. július 6., hétfő napi AI összefoglaló része.