AI-fogalom · Kutatás

Gondolatmenet-ösztönzés (chain-of-thought, CoT)

Olyan promptolási technika, amely arra ösztönzi a nyelvi modellt, hogy a válasz előtt lépésről lépésre kifejtse a gondolatmenetét.

Más néven: chain-of-thought prompting, CoT, lépésenkénti gondolkodás, gondolatlánc, step-by-step reasoning

A gondolatmenet-ösztönzés (chain-of-thought, CoT) egy promptolási módszer, amely során a nagy nyelvi modellt nem közvetlenül a végső válasz megadására kérjük, hanem arra, hogy előtte fejtse ki a megoldáshoz vezető köztes lépéseket is. Ez történhet úgy, hogy a kérdés végére egy egyszerű utasítást fűzünk, például azt, hogy gondolkodjon lépésről lépésre, vagy úgy, hogy a promptban néhány példát mutatunk, ahol a válaszokat részletes indoklás előzi meg.

A technika azért működik, mert a nyelvi modellek szekvenciálisan, tokenről tokenre generálnak szöveget, és minden újonnan generált token a korábban leírtakra épül. Ha a modell kénytelen előbb kimondani a részfeladatokat és köztes eredményeket, ezek olyan kontextust hoznak létre, amely segíti a helyes végkövetkeztetés megformálását. Ez különösen olyan feladatoknál hasznos, ahol több lépésben kell számolni, logikai következtetéseket levonni, vagy összetett problémát részekre bontani, mint a matematikai szöveges feladatok, kódolási problémák vagy többlépéses érvelést igénylő kérdések.

A gondolatmenet-ösztönzés jelentősége abban áll, hogy jelentősen javíthatja a modellek teljesítményét összetett feladatokon anélkül, hogy magát a modellt újra kellene tanítani, mindössze a prompt megfogalmazásán változtatva. Emellett a kiírt gondolatmenet átláthatóbbá teszi a modell működését, mivel az ember követni tudja, milyen lépéseken keresztül jutott a válaszhoz, bár fontos hangsúlyozni, hogy a leírt indoklás nem mindig tükrözi pontosan a modell belső számítási folyamatát.

A módszer alapjául szolgál számos újabb technikának is, például az önellenőrzést vagy többféle gondolatmenet összevetését alkalmazó eljárásoknak, valamint azoknak a modelleknek, amelyeket kifejezetten hosszabb, belső érvelési láncok generálására optimalizáltak.

← Vissza a fogalomtárhoz