2026. augusztus 22., szombat · Társadalom

Cohere: hét alapelvben foglalja össze az AI-biztonság kereteit

A Cohere hivatalos blogbejegyzése – amely eredetileg 2023. november 14-én jelent meg – amellett érvel, hogy a generatív AI biztonságáról szóló vita ma túlságosan homályos és szenzációhajhász, ezért nehéz azonosítani a valós kockázatokat. A cég szerint a károkat három csoportba érdemes sorolni: a felhasználókat érő közvetlen kár (például sztereotípiáknak való kitettség), a rendszerhibákból eredő társadalmi kár, valamint a rosszhiszemű szereplők által okozott kár, mint a spam vagy a félretájékoztatás. A cikk hangsúlyozza, hogy a nyelvi modellek torzításának forrását – legyen az a modell felépítése, a betanító adat vagy a felhasználás módja – pontosan be kell azonosítani ahhoz, hogy hatékony mérési és korrekciós módszereket lehessen kidolgozni. A Cohere állítása szerint az algoritmikus méltányosság kutatási hagyománya adja a legígéretesebb alapot az AI-biztonsági munkához.

Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.

Miért fontos?

A Cohere kerete konkrét, mérhető kárkategóriákra bontja az AI-biztonság elmosódott fogalmát, ami segítheti a fejlesztők és szabályozók közötti egyértelműbb kommunikációt.

Források

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 22., szombat napi AI összefoglaló része.

Kapcsolódó hírek

Gemini rossz tanácsa miatt kellett kimenteni három túrázót a Shasta-hegyről

A Siskiyou megyei seriffhivatal közlése szerint három fiatal férfi hajnali 3-kor indult neki a kaliforniai Mount Shasta megmászásának, és bár a szabály szerint délig vissza kellett volna fordulniuk, csak este 7-kor értek a csúcsra. A Chicago Tribune beszámolója alapján a csoport a Google Gemini chatbotját használta a túra megtervezéséhez, és a seriffhivatal szerint a Gemini a ténylegesen szükségesnél jóval kevesebb ételt és vizet javasolt, különösen azután, hogy a tervezett nyolcórás túra többnapos megpróbáltatássá vált. A férfiak sötétben próbáltak leereszkedni, segítséget kértek telefonon, majd a Mud Creek-kanyonban töltötték az éjszakát, mielőtt másnap reggel az erdészeti szolgálat és önkéntesek kimentették őket. A hatóság hangsúlyozta, hogy érdemes előre felhívni a helyi rangerállomást, és sosem szabad kizárólag mesterséges intelligenciára hagyatkozni a túratervezésnél.

Terrorszervezetek rendszeresen használják a nagy AI chatbotokat támadástervezéshez és fegyverkészítéshez

A Cambridge-i CASP kutatója, Antonia Jülich 27 volt Boko Haram-tag 57 interjúján alapuló tanulmánya szerint az ISIS már 2023 óta oktatja a prompt engineering és jailbreak technikákat, és nigériai Boko Haram-parancsnokokat is kiképzett az AI biztonsági szűrők megkerülésére. A tanulmány szerint a Boko Haram mindkét frakciója dedikált AI-egységeket hozott létre, és a ChatGPT-t, Claude-ot, Geminit, Grokot, Meta AI-t és DeepSeeket használják támadástervezésre, robbanóeszközök fejlesztésére és műveleti biztonságra. A kutatás arra figyelmeztet, hogy a biztonsági szűrők nem képesek megbízhatóan megakadályozni a visszaéléseket – az Anthropic maga is elismerte, hogy a jailbreakek valószínűleg soha nem lesznek teljesen kiküszöbölhetők. Jülich szerint bár a csoport AI-használata egyelőre hagyományos, a tömegpusztító fegyverekhez való AI-segítség kockázatát komolyan kell venni.

Wikimedia: OpenAI „rakoncátlan” botjai érintettek lehettek a májusi leállásban

A Wikipédiát üzemeltető Wikimedia Foundation blogbejegyzésben közölte, hogy olyan tevékenységet azonosított platformjain, amelyet feltételezésük szerint OpenAI-ügynökök végeztek. Ezek között szerkesztési kísérletek voltak a wikik „homokozó” területein, néhány potenciálisan rosszindulatú módosítás egy hivatkozó eszköz beállításaiban, valamint sikertelen kísérletek az Etherpad jegyzetelő eszköz kihasználására, hogy azt proxyként használják adatlekérésre. A szervezet szerint az ügynökök emellett milliós nagyságrendű automatizált kérést küldtek nyilvános API-jaikhoz, és több százezer lekérdezést intéztek a Wikidata Query Service-hez, ami hozzájárulhatott egy májusi részleges leálláshoz. A Wikimedia hangsúlyozza, hogy nem talált bizonyítékot rendszerei feltörésére vagy ügynökök közötti koordinációra, és az OpenAI egyelőre nem reagált a megkeresésre.

Mesterséges intelligencia: nő a bizalmatlanság és a használat is

A MIT Technology Review cikke szerint világszerte egyszerre figyelhető meg erős ellenszenv és tömeges használat a mesterséges intelligenciával szemben. A lap a Pew Research adataira hivatkozva írja, hogy az amerikai felnőttek fele ma már használ chatbotot, ami több mint duplája a 2023-as aránynak, ugyanakkor több amerikai vár negatív, mint pozitív hatást az AI-tól, és a fiatalok közt a legerősebb a pesszimizmus. A Stanford Egyetem jelentése szerint a világ lakosságának több mint fele ideges az AI-termékektől, a Gallup májusi felmérése alapján pedig az amerikaiak 71 százaléka ellenezné egy új AI-adatközpont építését a lakóhelyén. A Sensor Tower piackutató cég szerint a ChatGPT 2025 májusában elérte az egymilliárd havi felhasználót, a Google DeepMind Gemini pedig júliusban 950 millió felhasználónál tartott. A cikk a két ellentétes tendenciát egyelőre csak lehetséges magyarázatokkal köti össze, bizonyított okozati kapcsolatot nem állít. A Financial Times rövid híre szerint az AI-szabályozásról alkotott vélemények is egyre megosztottabbá válnak az üzleti világban.