2026. július 26., vasárnap · Modellek

Anthropic szerint az Opus 5 gyakorlatilag védett a prompt injection ellen

Az Anthropic saját rendszerkártyája szerint az Opus 5 modell böngészőügynökként futtatva 129 tesztforgatókönyv mindegyikében kivédte a prompt injection típusú támadásokat, azaz nulla százalékos sikerarányt mértek. Ez a nulla százalék csak akkor érvényes, ha az Auto Mode nevű kettős védelmi réteg is aktív: az egyik szűrő a bejövő adatokban keres rejtett utasításokat, a másik pedig a veszélyes műveleteket blokkolja végrehajtás előtt. Auto Mode nélkül az Opus 5 sikerrátája 3,7 százalék, míg a kisebb Sonnet 5 modellé 0,93 százalék. A Gray Swan biztonsági cég független tesztje szerint az általános prompt injection sikeraránya 15 kísérlet után 5,5 százalékról (Opus 4.8) 2,0 százalékra csökkent az új modellnél. Az OpenAI decemberben elismerte, hogy a prompt injection problémáját talán soha nem lehet teljesen megoldani, ami rávilágít az Anthropic állításának tétjére.

Miért fontos?

A prompt injection az AI-ügynökök egyik legsúlyosabb biztonsági kockázata, így egy gyártói mérés szerinti drasztikus javulás fontos, de független megerősítésre szoruló fejlemény.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. július 26., vasárnap napi AI összefoglaló része.

Kapcsolódó hírek

Anthropic Claude Opus 5: közel Fable-szintű teljesítmény fele áron

Az Anthropic bemutatta a Claude Opus 5 modellt, amelynek ára megegyezik elődjéével (5 dollár millió bemeneti, 25 dollár millió kimeneti tokenenként), de jóval olcsóbb, mint a csúcsmodell Fable 5. A cég szerint Opus 5 több benchmarkon megközelíti vagy meghaladja a Fable 5 és a GPT-5.6 Sol teljesítményét. A független Artificial Analysis mérés szerint Opus 5 Intelligence Index pontszáma 61, ami kissé megelőzi a Fable 5 (60) és a GPT-5.6 Sol (59) eredményét, ugyanakkor hallucinációs rátája 50 százalékra nőtt. Az Epoch AI szerint Opus 5 (159 pont) valamivel elmarad a Fable 5-től (161), szoftverfejlesztési benchmarkon viszont egyenrangúak. Az Anthropic kifejezetten nem adott a modellnek élvonalbeli kiberbiztonsági kiaknázási képességeket.

Az Anthropic kiadta a Claude Opus 5 modellt, amely megközelíti a Fable 5 képességeit

Az Anthropic csütörtökön bemutatta legújabb modelljét, a Claude Opus 5-öt, amelyről a vállalat azt állítja, hogy számos területen megközelíti a Fable 5 képességeit, és jelentősen jobb összetett kódolási feladatokban. A The Verge szerint a cég szóvivője megerősítette, hogy az Opus 5-öt is tesztelték kormányzati partnerekkel – összhangban a Fable 5 körüli szabályozási feszültségek után kialakult új felügyeleti gyakorlattal. Az Anthropic az Opus 5-öt vállalati ügyfeleknek szánja tudásmunkára és biológiai alkalmazásokra, míg a Fable 5 marad az ambiciózusabb projektekhez. Az árazás megegyezik az előd Opus 4.8-cal (5 dollár bemenet, 25 dollár kimenet millió tokenenként), ami a Fable 5 felének és a GPT-5.6-nál valamivel olcsóbbnak felel meg.

Az Anthropic Claude hangos módja mostantól az erősebb Opus és Sonnet modellekkel is elérhető

Az Anthropic bejelentette, hogy a Claude chatbot hangos üzemmódja mostantól nemcsak a gyengébb Haiku, hanem az Opus és a Sonnet modellekkel is használható. A The Verge beszámolója szerint a cég azért lépett, mert a felhasználók a hangos módot nem csupán gyors kérdésekre, hanem összetett üzleti problémák megoldására is elkezdték használni, amihez a Haiku nem volt elég mély. Az Anthropic állítása szerint a Sonnet és az Opus bonyolultabb elemzésekre és cselekvésekre is képes – például egy beszélgetésből egyoldalas pitchet készíthet, vagy átszervezheti a naptárbejegyzéseket. A felhasználók beszélgetés közben válthatnak szöveges és hangos mód, illetve modellek között. A hangos mód emellett kilenc új nyelven vált hivatalosan is elérhetővé, köztük francia, német, spanyol, japán és koreai nyelven.