AI-modell · Modellek
Claude
Az Anthropic által fejlesztett nagy nyelvi modellcsalád, amely szöveges és képi bemenetek feldolgozására, valamint párbeszédalapú asszisztensként való használatra készült.
Más néven: Claude AI, Anthropic Claude, Claude 2, Claude 3, Claude Opus, Claude Sonnet, Claude Haiku
A Claude az Anthropic mesterséges intelligencia-vállalat által fejlesztett nagy nyelvi modellcsalád neve, amelyet chatbot-alkalmazásokban, fejlesztői API-kon és vállalati integrációkban egyaránt használnak. A modellcsalád célja, hogy hasznos, ártalmatlan és őszinte válaszokat adjon, ehhez az Anthropic egy saját elvrendszert, az úgynevezett Constitutional AI módszertant alkalmazza a betanítás során, amely explicit etikai irányelvek mentén formálja a modell viselkedését emberi visszajelzés helyett vagy mellett.
A Claude modellek több méretben és képességszinten érhetők el, jellemzően egy gyorsabb, kisebb erőforrás-igényű változat és egy nagyobb, komplexebb feladatokra optimalizált verzió formájában, lehetővé téve a felhasználók számára, hogy a sebesség és a teljesítmény között válasszanak. A modellcsalád támogatja a hosszú kontextusablakokat, ami különösen hosszú dokumentumok, kódbázisok vagy beszélgetési előzmények feldolgozásában hasznos, emelllater verziói képfeldolgozási és kódgenerálási képességekkel is bővültek.
A Claude az egyik legismertebb versenytársa az OpenAI GPT és a Google Gemini modelleknek, és az Anthropic biztonságközpontú megközelítése miatt gyakran hivatkoznak rá az AI-biztonsági és -etikai diskurzusban. A modellcsaládot elérhetővé teszik közvetlen felhasználói felületen, API-n keresztül, valamint felhőplatformokon, például az Amazon Bedrock és a Google Cloud Vertex AI szolgáltatásain keresztül is.
Kapcsolódó szereplők és fogalmak
Claude a hírekben
-
Modellek 2026. július 25., szombat
Az Anthropic kiadta a Claude Opus 5 modellt, amely megközelíti a Fable 5 képességeit
Az Anthropic csütörtökön bemutatta legújabb modelljét, a Claude Opus 5-öt, amelyről a vállalat azt állítja, hogy számos területen megközelíti a Fable 5 képességeit, és jelentősen jobb összetett kódolási feladatokban. A The Verge szerint a cég szóvivője megerősítette, hogy az Opus 5-öt is tesztelték kormányzati partnerekkel – összhangban a Fable 5 körüli szabályozási feszültségek után kialakult új felügyeleti gyakorlattal. Az Anthropic az Opus 5-öt vállalati ügyfeleknek szánja tudásmunkára és biológiai alkalmazásokra, míg a Fable 5 marad az ambiciózusabb projektekhez. Az árazás megegyezik az előd Opus 4.8-cal (5 dollár bemenet, 25 dollár kimenet millió tokenenként), ami a Fable 5 felének és a GPT-5.6-nál valamivel olcsóbbnak felel meg.
-
Modellek 2026. július 24., péntek
Az Anthropic Claude hangos módja mostantól az erősebb Opus és Sonnet modellekkel is elérhető
Az Anthropic bejelentette, hogy a Claude chatbot hangos üzemmódja mostantól nemcsak a gyengébb Haiku, hanem az Opus és a Sonnet modellekkel is használható. A The Verge beszámolója szerint a cég azért lépett, mert a felhasználók a hangos módot nem csupán gyors kérdésekre, hanem összetett üzleti problémák megoldására is elkezdték használni, amihez a Haiku nem volt elég mély. Az Anthropic állítása szerint a Sonnet és az Opus bonyolultabb elemzésekre és cselekvésekre is képes – például egy beszélgetésből egyoldalas pitchet készíthet, vagy átszervezheti a naptárbejegyzéseket. A felhasználók beszélgetés közben válthatnak szöveges és hangos mód, illetve modellek között. A hangos mód emellett kilenc új nyelven vált hivatalosan is elérhetővé, köztük francia, német, spanyol, japán és koreai nyelven.
-
Üzlet 2026. július 23., csütörtök
Az AMD akár 5 milliárd dollárt fektet az Anthropicba, cserébe a Claude-fejlesztő az AMD chipjeit választja
Az AMD bejelentette, hogy akár 5 milliárd dolláros befektetést hajt végre az Anthropicban – a The Verge beszámolója szerint az ügylet részeként az Anthropic akár 2 gigawattnyi kapacitásban telepíti az AMD Instinct MI450 AI-gyorsítóit a chipgyártó új Helios rack-szintű rendszerében. Az első gigawattnyi kapacitást 2027 első felében tervezik üzembe helyezni. A partnerség emellett többéves mérnöki együttműködést is tartalmaz: az AMD saját szoftverfejlesztésében és terméktervezésében is alkalmazza majd az Anthropic Claude modelljét. Az Anthropic korábban a Google-lal, az Amazonnal, a SpaceX-szel és a TeraWulffal is kötött infrastrukturális megállapodásokat. A korábbi hírekhez képest – amelyek egy nem megerősített GitHub-profil alapján jelezték, hogy az Anthropic tesztelheti az AMD hardverét – most hivatalos, nagyszabású stratégiai megállapodás született a két cég között.
-
Kutatás 2026. július 23., csütörtök
Orvosi mesterséges intelligencia biztonságosságát torzítja az értékelő személye – hiányzó információ mellett
Egy nem lektorált kutatás négy nagy nyelvi modell (Claude Opus 4.8, GPT-5.5, Grok 4.3 és Gemini 3.5 Flash) orvosi biztonságosságát vizsgálta nyílt végű klinikai beszélgetésekben, ahol szándékosan hiányos információt kaptak a modellek. A szerzők szerint az értékelő megválasztása érdemben befolyásolja az eredményt: a négy LLM-bíró közötti egyezés csak közepes (Fleiss-kappa 0,65), és kimutatható pozitív torzítás, ha egy modellt saját szolgáltatójának bírája értékel. Az LLM-bírák ráadásul szignifikánsan engedékenyebbek voltak, mint a vakított klinikai szakértők: 66–84%-ban ismerték el a megfelelő bizonytalanságot, szemben a klinikus 52%-ával. A kutatók hangsúlyozzák, hogy a biztonsági rés nem tudáshiányból, hanem a kalibrációból ered, amit egy zárt végű MedQA-teszttel is alátámasztanak. A csoport a teljes tesztkeretrendszert, promptokat és annotációs protokollt nyilvánosan elérhetővé tette.
-
Modellek 2026. július 22., szerda
Tudósok értékelik a Kimi K3-at: fordulópontnak tartják a kínai AI-modellt
A Nature cikke szerint kutatók körében komoly visszhangot keltett a Moonshot AI múlt héten bemutatott Kimi K3 modellje. Joel Pearson, az UNSW Sydney kognitív idegtudósa szerint a modell "fordulópontot" jelent, egyesek pedig "Szputnyik-pillanatnak" nevezik. A cég saját tesztjei alapján a K3 kódolásban és táblázatkezelésben felveszi a versenyt amerikai riválisaival. A kereslet miatt a Moonshot AI három nappal a megjelenés után felfüggesztette az új regisztrációkat. Mehwish Nasim, a University of Western Australia AI-kutatója szerint a modell megjelenésének időzítése – az Anthropic Claude Fable 5 és az OpenAI GPT-5.6 debütálása után – azt jelzi, hogy Kína nemcsak élvonalbeli AI-rendszereket kíván építeni, hanem a nemzetközi AI-ökoszisztéma és szabályozás alakításában is részt akar venni.
-
Kutatás 2026. július 21., kedd
Az AI a toborzásban az embereknél is hajlamosabb sztereotípiák kialakítására – új kutatás
A Princeton Egyetem és a Chicagói Egyetem kutatói szimulált felvételi kísérletben vizsgálták, hogyan alakítanak ki sztereotípiákat a nagy nyelvi modellek. A ChatGPT-t, a Claude-ot és a Geminit is magában foglaló tesztben a modellek fiktív etnikai csoportokba tartozó jelölteket értékeltek negyven körön át, miközben minden jelölt valójában azonos eséllyel teljesített sikeresen. Az eredmények szerint a modellek a korai tapasztalatok alapján gyorsan elkezdték szegregálni a jelölteket, és a kutatók szegregációs skáláján mintegy 65 százalékkal magasabb értéket értek el az emberi résztvevőknél – az OpenAI o3 modellje közel a maximális szintet produkálta. A kutatók szerint az LLM-ek különösen hajlamosak kevés adatból általánosítani, ami az ágens-alapú, felhasználói részleteket megjegyző modellek terjedésével fokozott kockázatot jelent a munkaerő-felvételi döntésekben.
-
Modellek 2026. július 20., hétfő
A Moonshot Kimi K3 modellje frontend kódban vezet, de matematikában messze lemarad a nyugati riválisoktól
A Moonshot AI kínai Kimi K3 modellje a Code Arena frontend kód benchmarkján 1679 pontot ért el, ezzel megelőzve a Claude Fable 5-öt (1631) és a GPT-5.6 Sol-t (1618) is – a The Decoder beszámolója szerint ez az első alkalom, hogy kínai modell végzett az élen ezen a teszten. A kép ugyanakkor vegyes: az Epoch AI adatai alapján a Kimi K3 a FrontierMath Tier 4 nehéz matematikai feladatain mindössze 39 százalékos pontosságot ért el, míg az OpenAI és az Anthropic modelljei ugyanezeken a feladatokon egyes esetekben 90 százalék körüli eredményt produkáltak. A két benchmark tehát eltérő területeken mutatja a modell erősségeit és korlátait: a frontend fejlesztésben kiemelkedő, de komplex matematikai problémáknál jelentős a lemaradása.
-
Kutatás 2026. július 20., hétfő
Az AI-chatbotok veszélyesen magabiztosak a röntgendiagnózisban, még akkor is, ha tévednek
A RadLE 2.0 nevű benchmark 200 radiológiai eseten 16 mesterségesintelligencia-modellt tesztelt, és az eredményeket tapasztalt radiológusok teljesítményéhez hasonlította. Az Ashoka Egyetem CRASH Lab csapata által fejlesztett teszt nemcsak a diagnózis pontosságát, hanem a modell magabiztossági szintjét és a bizonytalanság beismerésének képességét is méri. A humán szakértők 988,7 pontot értek el a maximális 2000-ből, míg a legjobb AI-modell 758-at. A tanulmány szerint egyetlen modell sem győzött minden kategóriában: az Anthropic Claude Fable 5 a megbízhatóságban, a Google Gemini 3 Pro a nyers találati arányban, a Meta Muse Spark 1.1 pedig a saját korlátainak felismerésében teljesített a legjobban. A pontozás bünteti a magabiztos tévedést, mivel az orvoslásban egy hamisan határozott diagnózis sokkal veszélyesebb, mint a bizonytalanság őszinte bevallása.
-
Üzlet 2026. július 20., hétfő
Az Anthropic és a Meta akár 10 milliárd dolláros számítási kapacitás bérleti megállapodásról tárgyal
A New York Times információira hivatkozva a The Decoder arról számolt be, hogy a Meta tárgyalásokat folytat az Anthropic-kal adatközponti számítási kapacitás bérbeadásáról; az üzlet két év alatt akár 10 milliárd dollárt is elérhet. Az Anthropic júniusban terjesztette elő az ajánlatot, a Meta még vizsgálja azt, és bármelyik fél visszaléphet. Mark Zuckerberg korábban jelezte a befektetőknek, hogy a felesleges kapacitást értékesíthetik, ha a Meta saját AI-igénye nem nő elég gyorsan – a vállalat idén akár 145 milliárd dollárt is költhet, nagyrészt mesterséges intelligenciára. Az Anthropic oldalán a Claude Code iránti megnövekedett kereslet indokolja a többletkapacitás szükségességét, bár hosszú távon saját adatközpontokat kíván építeni, amelyek irányítására korábbi Google-vezetőket szerződtetett.
-
Kutatás 2026. július 16., csütörtök
Az automatikus harness-evolúció hatékonyságát kérdőjelezi meg egy új értékelési keretrendszer
Kutatók felülvizsgálták az LLM-ágensekhez használt automatikus harness-evolúció értékelési módszertanát egy még nem lektorált tanulmányban. A szerzők két alapvető problémát azonosítanak: egyrészt a harness-evolúció iteratív keresési folyamat, amelyet azonos visszacsatolási és inferencia-költségvetés mellett egyszerű keresési alapvonalakkal kellene összehasonlítani; másrészt a keresés és a végső kiértékelés ugyanazon a benchmarkon zajlik, ami túlillesztési kockázatot jelent. A Terminal-Bench 2.1 benchmarkon GPT-5.4 és Claude Opus 4.6 modellekkel végzett kísérleteik szerint az automatikus harness-evolúció nem múlja felül következetesen az egyszerű tesztelési idejű skálázási módszereket, és korlátozott az általánosítóképessége tartott (held-out) feladatokon. A szerzők tisztességesebb értékelési protokollok és benchmarkok kialakítását szorgalmazzák az automatikus harness-tervezéshez.
-
Eszközök 2026. július 13., hétfő
A Claude Code beépített böngészőt kapott: az AI közvetlenül olvashat és kattinthat külső weboldalakon
Az Anthropic beépített böngészőablakot adott a Claude Code fejlesztői eszközhöz, amellyel az AI-ügynök közvetlenül megnyithat, olvashat, és interakcióba léphet külső weboldalakkal – beleértve dokumentációs oldalakat és hibakövetőket. A The Decoder beszámolója szerint a böngésző billentyűparanccsal nyílik meg, lapfüles felületet kínál, és ugyanazokat az eszközöket használja, amelyekkel a helyi alkalmazások előnézetét is kezeli, kiegészítve biztonsági szűrőkkel. Az Anthropic közlése alapján osztályozók ellenőrzik a külső oldalakon végzett írási műveleteket, és Claude a felhasználó beleegyezése nélkül nem vásárol, nem hoz létre fiókot és nem kerül meg CAPTCHA-kat. A böngésző tiszta profillal fut, mentett bejelentkezések nélkül. A szervezetek engedélyezési listával korlátozhatják az elérhető külső oldalakat, vagy teljesen letilthatják a böngészőeszközöket.
-
Társadalom 2026. július 12., vasárnap
Terrorszervezetek rendszeresen használják a nagy AI chatbotokat támadástervezéshez és fegyverkészítéshez
A Cambridge-i CASP kutatója, Antonia Jülich 27 volt Boko Haram-tag 57 interjúján alapuló tanulmánya szerint az ISIS már 2023 óta oktatja a prompt engineering és jailbreak technikákat, és nigériai Boko Haram-parancsnokokat is kiképzett az AI biztonsági szűrők megkerülésére. A tanulmány szerint a Boko Haram mindkét frakciója dedikált AI-egységeket hozott létre, és a ChatGPT-t, Claude-ot, Geminit, Grokot, Meta AI-t és DeepSeeket használják támadástervezésre, robbanóeszközök fejlesztésére és műveleti biztonságra. A kutatás arra figyelmeztet, hogy a biztonsági szűrők nem képesek megbízhatóan megakadályozni a visszaéléseket – az Anthropic maga is elismerte, hogy a jailbreakek valószínűleg soha nem lesznek teljesen kiküszöbölhetők. Jülich szerint bár a csoport AI-használata egyelőre hagyományos, a tömegpusztító fegyverekhez való AI-segítség kockázatát komolyan kell venni.
-
Modellek 2026. július 10., péntek
Az OpenAI nyilvánosan elérhetővé tette a GPT-5.6 modellt és bemutatta a ChatGPT Work AI-ágenst
Az OpenAI a Trump-kormányzat jóváhagyását követően megkezdte a GPT-5.6 modellcsalád (Sol, Terra, Luna) nyilvános bevezetését – a modellt korábban csak engedélyezett szervezetek használhatták korlátozott előzetesben. Sam Altman vezérigazgató a cég eddigi legjobb modelljének nevezte. Ezzel egyidejűleg az OpenAI bemutatta a ChatGPT Work nevű AI-ágenst, amely a ChatGPT és a Codex képességeit egyesíti, és a The Verge szerint dokumentumok, táblázatok, prezentációk készítésére, valamint Slack, Gmail, Google Drive és más eszközök integrálására képes. A desktop alkalmazáson keresztül az ingyenes felhasználók is hozzáférhetnek, míg mobilon és weben a Pro, Enterprise és Edu felhasználók kapnak elsőként hozzáférést. Az OpenAI a terméket az Anthropic Claude Cowork közvetlen versenytársaként pozicionálja az AI-ágensek piacán.
-
Üzlet 2026. július 10., péntek
Az Anthropic használatalapú díjat vezet be a Claude Fable 5 fogyasztói eléréséhez
Július 12-től az Anthropic előfizetői – a havi 20, 100 és 200 dolláros csomagok tulajdonosai – a havi díj mellett használatalapú pótdíjat fizetnek a Claude Fable 5 modell eléréséért. A WIRED szerint a fogyasztói árazás megegyezik a fejlesztői API-díjakkal: egymillió küldött tokenért 10, egymillió generált tokenért 50 dollár jár. Ez az első alkalom, hogy egy vezető AI-labor fogyasztói modelljét használatalapú számlázáshoz köti. Az Anthropic a lépést az iparági trendhez illeszti: a cég szerint az AI-ügynökök – például a Claude Code – lényegesen több számítási kapacitást igényelnek a hagyományos chatbotoknál, ami a korlátlan előfizetéseket fenntarthatatlanná teszi. A WIRED megjegyzi, hogy a változás összefügghet az Anthropic tervezett tőzsdei bevezetésével is.
-
Eszközök 2026. július 9., csütörtök
Az Anthropic bemutatta a Claude apps gateway-t AWS-hez: központosított kontroll a vállalati Claude-használat felett
Az Anthropic és az AWS közösen bejelentette a Claude apps gateway for AWS szolgáltatást, amely egy önállóan hosztolható vezérlősík a Claude Code és Claude Desktop vállalati szintű kezeléséhez. A gateway egyetlen központi ponton biztosítja a hozzáférés-kezelést, a költségkontrollt és a szabályzatok érvényesítését, kiváltva az egyéni fejlesztői hitelesítő adatok külön kiépítését. A megoldás bármely OIDC-kompatibilis identitásszolgáltatóval integrálható, rövid élettartamú tokenekkel dolgozik, és az Amazon Bedrock vagy a Claude Platform on AWS infrastruktúrán telepíthető. A rendszer öt fő feladatot lát el: identitáskezelés, szabályzat-érvényesítés, költségkövetés, modell-hozzáférés és eszközengedélyek központi szabályozása. Az Anthropic szerint a gateway egyetlen állapotmentes konténerként futtatható, PostgreSQL adatbázissal a háttérben.
-
Eszközök 2026. július 8., szerda
Az Anthropic Claude Cowork ügynöke mostantól mobilon és weben is elérhető, felhőben fut a háttérben
Az Anthropic kedden bejelentette, hogy a korábban csak asztali alkalmazásként elérhető Claude Cowork AI-ügynök mostantól iOS-en, Androidon és böngészőben is használható. A The Verge és a WIRED egyaránt megerősíti, hogy a Cowork immár alapértelmezetten felhőben fut, így a feladatok a felhasználó laptopjának bezárása után is folytatódnak, és az ütemezett feladatok akkor is lefutnak, ha egyetlen eszköz sincs online. A mobilos és webes verzió a cég szerint nem tartalmazza az asztali alkalmazás összes funkcióját, például a helyi fájlhozzáférést. Az új funkciók először a Max előfizetőknek érhetők el, más csomagokra a következő hetekben terjesztik ki. Az Anthropic emellett augusztus 5-ig meghosszabbította a megduplázott Cowork-használati limitet.
-
Üzlet 2026. július 6., hétfő
A Claude modellek elérhetők a Microsoft Foundry-n, de európai vállalatok nem tudják megfelelően használni adatvédelmi okokból
Az Anthropic és a Microsoft bejelentette a Claude modellek (Opus 4.8, Haiku 4.5, majd Sonnet 5) általános elérhetőségét a Microsoft Foundry platformon, Azure-natív hitelesítéssel, számlázással és jogosultságkezeléssel. A Microsoft dokumentációja szerint azonban az Anthropic a promptok és kimenetek független adatfeldolgozója marad, és jelenleg nem létezik európai adatzóna a Claude modellekhez – a feldolgozás Global Standard.
-
Eszközök 2026. július 6., hétfő
A Google DeepMind fejlesztője a Claude Code segítségével pár óra alatt portolta az iOS-re a Command & Conquer-t
Ammaar Reshi, a Google AI Studio vezető termék- és dizájnfelelőse az Anthropic Claude Code és a Fable 5 AI-eszközök segítségével a 2003-as Command & Conquer: Generals Zero Hour PC-játékot natív iOS-alkalmazássá alakította – saját állítása szerint az első build mintegy 40 perc alatt készült el, amit néhány órányi hibakeresés követett, összesen két nap alatt. A The Decoder beszámolója szerint a játék ARM64-re fordítva, emulátor nélkül fut iPhone-on és iPaden, a DirectX 8 grafikus csővezetéket több köztes lépésen át az Apple Metal API-jára fordítja. A kampány, csatározás és a Generals Challenge módok érintőképernyős vezérléssel működnek, bár iPaden a hosszabb játékmenetek memóriaproblémák miatt összeomláshoz vezethetnek. Reshi a teljes forráskódot nyílt forráskódúként közzétette GitHubon – a játék futtatásához saját, megvásárolt asset-ekre van szükség.
-
Társadalom 2026. július 5., vasárnap
Háború a rajongói irodalomban: AI-detektáló eszköz osztja meg az AO3 közösségét
Az Archive of Our Own (AO3) rajongói irodalmi platformon egy anonim fejlesztő olyan bőrt (skin-t) tett közzé, amely állítása szerint képes kimutatni az Anthropic Claude chatbotból közvetlenül beillesztett szövegeket. Az eszköz a Claude által hagyott kódjelölés ("font-claude-response-body") alapján piros háttérrel jelöli meg az érintett műveket. A The Verge tesztjei szerint a jelölés valóban megjelent a közvetlenül Claude-ból másolt szövegeknél, de eltűnt, ha ugyanazt a generált szöveget más forrásból illesztették be. A közösség gyorsan reagált: egyes tagok nyilvánosan megbélyegezték a megjelölt szerzőket, ami vitát váltott ki, mivel a módszer megbízhatósága kérdéses, és ártatlan alkotókat is érinthet. Az eszköz készítője hangsúlyozta, hogy nem célja a bizalmatlanság légkörének megteremtése, de a rajongói alkotás emberi jellegének védelméért szükségesnek tartja a fellépést.
-
Eszközök 2026. július 5., vasárnap
A pxpipe nyílt forráskódú eszköz PNG-képekbe rejtett szövegekkel akár 70%-kal csökkenti a Claude Code tokenköltségeit
A pxpipe nevű nyílt forráskódú eszköz helyi proxyként működik: a Claude Code-nak küldött kérésekből a nagyméretű, statikus szövegrészeket – rendszerpromptokat, eszközdokumentációkat, régebbi üzenetelőzményeket – tömör PNG-képekké alakítja. A trükk az Anthropic képárazásán alapul: míg szövegként egy karakter nagyjából egy tokent jelent, addig a képek rögzített tokenszámmal számolódnak a pixelméret alapján, tartalmukra tekintet nélkül. A fejlesztő, Steven Chong szerint a megtakarítás átlagosan 59-70%, egy Fable 5 demóban a munkamenet költsége 42,21 dollárról 6,06 dollárra esett. A módszernek hátrányai is vannak: veszteséges, pontos karakterláncok (pl. hash-ek) torzulhatnak, és a feldolgozás lassabb, mivel a modellnek vizuális enkóderen kell átfuttatnia a képeket. Ha az eljárás elterjed, az AI-cégek a képfeldolgozás árazásának módosításával reagálhatnak.
-
Modellek 2026. július 5., vasárnap
Anthropic fejlesztő: a Fable 5 modellnél a felhasználó saját vakfoltjainak felismerése a kulcs a jó promptoláshoz
Thariq Shihipar, az Anthropic fejlesztője szerint a Claude új Fable 5 modelljénél a kimenetek minőségét elsősorban az határozza meg, mennyire képes a felhasználó felismerni saját tudásbeli hiányosságait a prompt megírása előtt. Shihipar a Rumsfeld-féle tudásmátrixra építve kategorizálja az ismereteket: az ismeretlen ismeretlenek.
-
Üzlet 2026. július 5., vasárnap
Az Alibaba betiltja a Claude Code használatát alkalmazottai számára
Több forrás szerint az Alibaba július 10-től megtiltja alkalmazottainak az Anthropic Claude Code programozói eszközének használatát, és magas kockázatú szoftvernek minősítette azt. A vállalat ehelyett saját fejlesztésű Qoder eszközét ajánlja dolgozóinak. A lépés annak fényében történik, hogy az Anthropic saját szabályzata szerint is tiltja kínai cégek és azok külföldi leányvállalatai számára modelljeinek használatát, és a cég aktívan dolgozik a kiskapuk bezárásán. Egy Reddit-bejegyzés szerint a Claude Code egy korábbi verziója képes volt azonosítani kínai felhasználókat; az Anthropic munkatársa, Thariq Shihipar ezt egy márciusban indított kísérletként jellemezte, amelynek célja az illetéktelen viszonteladók és a desztilláció elleni védelem volt. A két technológiai nagyvállalat közötti feszültség az amerikai–kínai AI-verseny szélesebb kontextusába illeszkedik.
-
Kutatás 2026. július 4., szombat
ContextSniper: tokenhatékony kódmemória-réteg, amely felére csökkenti a tokenhasználatot repó-szintű hibajavításnál
Az AntTrail csapata ContextSniper néven tokenhatékony kontextuskezelő réteget mutatott be, amely nagy nyelvi modellek ügynökein működve célzottan szűri a kódjavításhoz szükséges bizonyítékokat. A rendszer hibrid keresési jelekkel rangsorolja a releváns kódrészleteket, szándéktudatos szűrőn engedi át a hosszú kimeneteket, és kompakt evidenciacsomagokat ad vissza a modellnek. A szerzők nem lektorált preprintjükben a SWE-bench Lite benchmarkon, OpenClaw és Claude Code ügynökökkel végzett kísérleteikről számolnak be: az OpenClaw esetében 51,5%-kal, a Claude Code-nál 38,9%-kal csökkent a tokenfelhasználás, míg a javítási sikerráta csak kis mértékben esett vissza (26%-ról 24%-ra, illetve 32%-ról 30%-ra). A tesztelő szkriptjeiket nyílt forráskóddal tették elérhetővé.
-
Üzlet 2026. július 4., szombat
Az Anthropic saját gyógyszereket fejlesztene, és elindította a Claude Science tudományos platformot
Az Anthropic bemutatta a Claude Science nevű, tudósoknak szánt munkafelületet, amely szétszórt eszközöket és adatbázisokat fog össze egyetlen környezetbe, és ábrák, vizualizációk generálására is képes. A cég ezen túlmenően bejelentette, hogy saját gyógyszerfejlesztésbe kezd: Eric Kauderer-Abrams, az élettudományi részleg vezetője szerint elhanyagolt betegségek kezelésére összpontosítanának. A The Verge szerint az Anthropic ezzel az egyik legközvetlenebb kísérletet teszi arra, hogy egy vezető AI-vállalat maga fejlesszen gyógyszereket, miközben szoftvereit potenciális versenytársaknak is értékesíti. Ugyanakkor a cég nem közölt konkrétumokat a célbetegségekről, partnerségekről vagy a klinikai fejlesztés módjáról. Szakértők a lapnak azt nyilatkozták, hogy a részletek hiánya az AI-alapú gyógyszerfejlesztés körüli általánosabb bizonytalanságot tükrözi.
-
Modellek 2026. július 3., péntek
Ausztrál startup az AI-csoportgondolkodás ellen: a Springboards Flint modellje változatosabb válaszokat ígér
A legtöbb nagy nyelvi modell – köztük a ChatGPT, Claude és Gemini – meglepően kiszámítható válaszokat ad nyitott kérdésekre: ha véletlenszámot kérünk 1 és 10 között, szinte mindig a 7-et kapjuk. A MIT Technology Review beszámolója szerint az ausztrál Springboards startup erre a problémára fejlesztette ki Flint nevű nagy nyelvi modelljét, amelyet kifejezetten arra tanítottak, hogy nyitott végű kérdéseknél – például úticél-ajánlásoknál – szélesebb válaszskálát kínáljon a mainstream modellekénél. A jelenség azért fontos, mert bár a kiszámíthatóság kódolási vagy kutatási feladatoknál elfogadható, az ötletelés és kreatív tervezés területén az AI-csoportgondolkodás komoly korlátot jelent. A Flint pontos teljesítményéről és összehasonlító teszteredményeiről a forrás nem közöl részleteket.
-
Szabályozás 2026. július 2., csütörtök
Az USA feloldotta az Anthropic Fable 5 és Mythos 5 modelljeire vonatkozó exportkorlátozásokat
Az amerikai kereskedelmi minisztérium feloldotta az Anthropic Claude Fable 5 és Mythos 5 modelljeire három héttel ezelőtt bevezetett exporttilalmat. Howard Lutnick kereskedelmi miniszter az Anthropicnak küldött levelében közölte, hogy a modellek exportjához és belföldi továbbításához már nem szükséges engedély. A döntés hátterében az áll, hogy az Anthropic – a forrásokkal egyező beszámolók szerint – szorosabb együttműködést vállalt a kormánnyal: vörös csapat programot indított hackerekkel, 24/7 figyelőcsapatot állított fel a jailbreak-fenyegetések nyomon követésére, és bővítette a Glasswing kiberbiztonsági programot. A WIRED szerint az Anthropic kommunikációs stratégiát is váltott: ahelyett, hogy vitatta volna a jailbreakek teljes megakadályozhatóságát, inkább erősebb biztonsági intézkedéseket ígért. A kormány fenntartotta jogát az exportkorlátozások bármikori visszaállítására.
-
Üzlet 2026. július 2., csütörtök
Az Anthropic bemutatta a Claude Science-t, miközben az USA feloldotta a Fable 5 és Mythos 5 modellekre vonatkozó korlátozásokat
Az Anthropic egy gyógyszeripari vezetőknek és kutatóknak tartott rendezvényen bemutatta a Claude Science nevű új termékét, amelyet a tudományos kutatás – különösen a számítógépes biológia és a gyógyszerfejlesztés – támogatására terveztek. A cég állítása szerint a rendszer a Claude Code-hoz hasonlóan magas szintű utasítások alapján önállóan végez érdemi munkát. Az Anthropic saját ritka betegségekre irányuló gyógyszerkutatásaiban is alkalmazni kívánja az eszközt. Ezzel párhuzamosan a WIRED forrásai szerint az amerikai Kereskedelmi Minisztérium feloldotta a Fable 5 és Mythos 5 modellekre vonatkozó exportkorlátozásokat, miután az Anthropic új biztonsági intézkedést vezetett be: a kényes kiberbiztonsági és biológiai kéréseket a kevésbé fejlett Opus 4.8 modell kezeli. A védelmi minisztérium ellátási láncra vonatkozó kockázati besorolása azonban a WIRED szerint továbbra is érvényben van.
-
Kutatás 2026. június 30., kedd
NormAct: új benchmark méri, hogy az AI-tervezők felismerik-e a rejtett társadalmi normákat
A NormAct nevű benchmark azt vizsgálja, képesek-e a multimodális nagy nyelvi modellek (MLLM-ek) a megtestesült (embodied) cselekvéstervezés során nemcsak az explicit célokat teljesíteni, hanem a ki nem mondott társadalmi normákat is betartani. A még nem lektorált kutatás szerint a tesztelt modellek (a szerzők GPT-5.4, Claude Opus 4.7 és Gemini 3 Pro megjelöléssel hivatkoznak rájuk) az explicit célokat az esetek 67,3%-ában érték el, de a rejtett normákat mindössze 26,4%-ban tartották be. A kutatók kimutatták, hogy a lemaradás nem az általános társadalmi tudás hiányából fakad, hanem abból, hogy a modellek nehezen aktiválják a releváns normákat a kontextusban. Megoldásként a NormPerceptor nevű kontextusfüggő jelzésgenerátort javasolják, amely a tervezés előtt feltárja a jelenethez illő normákat, és a teljes feladatsikert 24,2%-ról 46,7%-ra növelte a szerzők mérései alapján.
-
Kutatás 2026. június 29., hétfő
A Sina háromparaméteres VibeThinker-3B modellje a százszor nagyobb modellek szintjén teljesít matekban és kódolásban
A kínai Sina (Weibo anyavállalata) kiadta VibeThinker-3B modelljét, amely mindössze 3 milliárd paraméterrel egyes matematikai és kódolási benchmarkokon – a cég technikai jelentése szerint – a 200-333-szor nagyobb modellekkel, például a DeepSeek V3.2-vel és a Kimi K2.5-tel vetekszik. A modell az Alibaba Qwen2.5-Coder-3B alapmodelljére épül, a teljesítményt többlépcsős utóképzéssel érik el. A LeetCode-versenyeken (2026 április–május) 128-ból 123 feladatot elsőre megoldott, megelőzve a GPT-5.2-t és a Claude Opus 4.6-ot – állítja a Sina. Ugyanakkor a széles tárgyi tudást igénylő GPQA-Diamond benchmarkon a modell jelentősen elmarad nagyobb riválisaitól. A kutatók következtetése szerint a strukturált logikai gondolkodás jól tömöríthető kis modellekbe, de a faktikus világtudás továbbra is nagy paraméterszámot igényel.
-
Társadalom 2026. június 28., vasárnap
Margaret Atwood kipróbálta a Claude chatbotot, és kemény szavakkal illette az AI-t
Margaret Atwood, a Szolgálólány meséje szerzője a portugáliai Babell Irodalmi és Kulturális Fesztiválon beszélt az AI-ról. A Deadline beszámolója szerint az írónő elmondta, hogy egyetlen egyszer próbált ki AI chatbotot – az Anthropic Claude-ját –, amely szerinte téves választ adott a Father Brown brit krimiszériával kapcsolatban. Atwood szerint a modell félrevezető televíziós kritikákból dolgozott, amelyek nem árulták el a végkifejletet, így hibás következtetésre jutott. Az AI-t használókat "opportunistáknak" nevezte, akik a könnyebb utat keresik, és hangsúlyozta: az LLM-ek csak annyit érnek, amennyit a betáplált adataik, vagyis "szemét be, szemét ki". Hozzátette, hogy még az üzleti felhasználóknak is ellenőrizniük kell az AI válaszait, mert hibákat vét.
-
Üzlet 2026. június 27., szombat
OpenAI saját chipet mutat be, az Alibaba pedig az Anthropic adatait lopta el – az AI-verseny új szintre lép
Az OpenAI bemutatta saját mesterséges intelligencia chipjét, amellyel csökkenteni kívánja függőségét az Nvidia-tól és erősíteni piaci pozícióját. Ezzel párhuzamosan kiderült, hogy az Alibaba kínai AI-modelljét részben az Anthropic Claude válaszainak engedély nélküli felhasználásával tanították be, ami komoly etikai és jogi kérdéseket vet fel. Az AI-láz a technológiai eszközök árait is felfelé hajtja globálisan, miközben az Apple is átírta chipfejlesztési ütemtervét: az M6 Pro és M6 Max sorozatot lemondták, hogy az AI-ra optimalizált M7 generációra összpontosíthassanak. Egy friss tanulmány szerint az AI negatívan befolyásolja a videojátékok eladásait is, jelezve, hogy a technológia hatása már a szórakoztatóiparra is kiterjed.
-
Üzlet 2026. június 26., péntek
Az Anthropic az Alibabát vádolja a Claude jogosulatlan használatával, miközben egyre több fizető felhasználót szerez
Az Anthropic azzal vádolja az Alibabát, hogy hamis fiókok segítségével jogosulatlanul fértek hozzá Claude nevű mesterséges intelligencia chatbotjához, és megpróbálták kinyerni annak képességeit. A vállalat szerint a kínai e-kereskedelmi óriás szisztematikusan próbálta megkerülni a hozzáférési korlátokat. Mindeközben friss adatok szerint az előfizetéses AI-piacon az Anthropic egyre erősebb versenytársa lesz a ChatGPT-nek: a fizető felhasználók körében növekvő arányban választják a Claude-ot az OpenAI megoldásával szemben.
-
Üzlet 2026. június 26., péntek
Az Anthropic egyszerre terjeszkedik Európában és jogi lépéseket tesz az Alibaba ellen
Az Anthropic felvette az Orange telekommunikációs vállalat mesterséges intelligencia vezetőjét, jelezve, hogy komolyan veszi európai terjeszkedését. Ugyanakkor a cég jogi eljárást indított az Alibaba ellen, amelyet azzal vádol, hogy 25 000 fiókot használt fel a Claude AI modell adatainak tömeges kinyerésére. Az állítólagos támadás során 28,8 millió üzenetváltást hajtottak végre az illegális adatgyűjtés érdekében. Az Anthropic szerint ez a valaha dokumentált legnagyobb ilyen jellegű, modellklónozásra irányuló akció.
-
Kutatás 2026. június 25., csütörtök
Az Anthropic Claude MI órák alatt feltörte a titkosított amerikai rendszereket
Az Anthropic mesterséges intelligenciája, a Claude, néhány órán belül képes volt feltörni titkosított amerikai rendszereket, ami komoly biztonsági aggályokat vet fel. A kísérlet rávilágított arra, hogy a fejlett MI-modellek milyen gyorsan képesek megkerülni a jelenlegi digitális védelmi megoldásokat. Az eset egyre sürgetőbbé teszi az MI kockázataira vonatkozó figyelmeztetések komolyan vételét, amelyeket különböző szervezetek is hangoztatnak. A kiberbiztonság területén ez az esemény alapvetően kérdőjelezi meg a meglévő titkosítási rendszerek megbízhatóságát az MI-korszakban.