2026. augusztus 20., csütörtök · Modellek

Z.ai GLM-5.3 modellje vezeti a nyílt rangsort, de késik a súlyok kiadása

A kínai Z.ai új GLM-5.3 modellje 60 pontot ér el az Artificial Analysis Intelligence Indexen, amivel holtversenyben az élre kerül a Kimi K3-mal a nyílt modellek között, hét ponttal megelőzve elődjét, a GLM-5.2-t. A legnagyobb javulás az ágensfeladatokban mutatkozik: a GDPval-AA v2 benchmarkon az Elo-pontszám 1524-ről 1770-re ugrik, így a modell a második helyre kerül, csak a Claude Opus 5 (1855) mögött. Árban a GLM-5.3 feladatonként 0,68 dollárba kerül, ami drágább elődjénél, de 19 százalékkal olcsóbb, mint a Kimi K3. A modell egyelőre csak a Z.ai API-ján elérhető, a nyílt súlyok kiadását a vállalat állítása szerint mintegy két héttel elhalasztják biztonsági okokból, mivel a modell hatékonyan ismer fel sebezhetőségeket, és előbb csak kiválasztott partnereknek adják át.

Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.

Miért fontos?

Az Artificial Analysis független mérései szerint a GLM-5.3 a legerősebb nyílt modellek közé került, és olcsóbb a Kimi K3-nál (bár drágább elődjénél), ami éleződő versenyt jelez a nyílt súlyú modellek piacán.

Források

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 20., csütörtök napi AI összefoglaló része.

Helyesbítés · 2026. október 2., péntek

Helyesbítés (2026-10-02): a „Miért fontos?” „A vállalati mérési adatok” alapján a modellt „egyben legolcsóbb” nyílt modellnek nevezte; a számok az Artificial Analysis független méréseiből származnak, és a GLM-5.3 elődjénél drágább, csak a Kimi K3-nál olcsóbb.

Kapcsolódó hírek

Z.ai áll a rejtélyes Ox Alpha modell mögött

Hétvégén sokat találgattak, melyik AI-labor készítette az OpenRouteren névtelenül feltűnt, benchmarkokon élen járó Ox Alpha nyílt súlyú modellt. A TechCrunch szerint a Bloomberg értesülésére hivatkozva a GLM-sorozatot jegyző Z.ai áll mögötte, amit a cég meg is erősített: Ox Alpha a GLM-család legújabb tagja. A Z.ai szerint a modell kódolásra, hosszan tartó ágensi munkára és éles üzemi feladatokra tervezett rendszer, amely komplex, hosszú távú szoftverfejlesztési munkát és vizuális kontextussal kombinált feladatokat is kezel. A TechCrunch augusztus 26-i, szerdai cikke szerint a cég aznap teszi közzé a modell súlyait, ezután a fejlesztők építhetnek rá. A TechCrunch szerint az olcsó, versenyképes kínai modellek – köztük a korábban bemutatott GLM-5.3, amely egyes benchmarkokon az Anthropic Fable 5 modelljével vetekszik – piaci részesedést vehetnek el az olyan drága, élvonalbeli cégektől, mint az OpenAI és az Anthropic.

Google bemutatta az EmbeddingGemma 2 nyílt, könnyűsúlyú multimodális beágyazó modellt

A Google kiadta az EmbeddingGemma 2 nevű nyílt modellt, amely szöveget, képet, videót, hangot és kódot alakít numerikus vektorokká, hogy hasonló tartalmakat könnyebben lehessen keresni és összehasonlítani. A Google állítása szerint ez a legkompaktabb ilyen típusú modell a maga 740 millió paraméterével, és a multimodális beágyazási benchmarkokon felülmúlja a nála akár kétszer nagyobb versenytárs modelleket is. A modell API-kulcs nélkül, helyben futtatható: egy lekérdezés WebGPU-n keresztül böngészőben 20-70 ezredmásodpercet vesz igénybe, mindössze körülbelül 191 MB memóriát igényel, és akár hatszorosára csökkenti a helyi vektoradatbázisok tárolási igényét. Csak szöveges feladatokhoz egy 270 millió paraméteres, kisebb változat is elegendő. A Gemma 4-hez hasonló kis nyílt modellekkel párosítva offline, szerverre küldött adatok nélkül futó RAG-alkalmazások építhetők; a súlyok elérhetők a Hugging Face-en és a Kaggle-ön.

Elérhető az Anthropic Claude Haiku 5.5 modellje az AWS-en

Az AWS bejelentette, hogy a Claude Haiku 5.5 mostantól elérhető az Amazon Bedrocköz és a Claude Platformon keresztül is. Az Anthropic állítása szerint ez a Claude 5.5 család leggyorsabb és leghatékonyabb tagja, amelyet kifejezetten subagentekhez és nagy volumenű, költségérzékeny feladatokhoz fejlesztettek, és a legtöbb feladatnál mintegy 75 százalékkal olcsóbb, mint a Claude Haiku 4.5. A modell az első Haiku, amely úgynevezett effort control funkciót kapott, így feladatonként állítható a költség és a képesség aránya. A Bedrocköz kapcsolódva a vállalati adatok az AWS infrastruktúráján belül maradnak, és a megszokott AWS-eszközök (IAM, CloudTrail, CloudWatch, Bedrock Guardrails) is használhatók mellette. A gyártó szerint a modell jól teljesít kódolási, eszközhasználati és agentikus feladatokban, valamint ismétlődő böngésző- és asztali műveleteknél is.

Mistral Large 4: billió paraméteres, Európában épített AI-modell kiberbiztonsági éllel

A Mistral AI nyilvános előnézetben elérhetővé tette a Mistral Large 4-et (ML4), egy billió paraméteres, natívan multimodális modellt, amelyet a cég saját európai adatközpontjaiban, 3800 NVIDIA Grace Blackwell GPU-n tanított; a teljes súlyokat október végén adják ki. A Mistral állítása szerint ML4 a legjobb nyílt súlyozású modell az USA-ból vagy Európából, és élen jár kiberbiztonsági, pénzügyi és jogi feladatokban, mert sebezhetőségeket is reprodukál és javít, amit a versenytársak biztonsági szűrői gyakran megtagadnak. A független Artificial Analysis Intelligence Index szerint ML4 38 pontot ért el, ami jelentős ugrás a Mistral Large 3 9 és a Mistral Medium 3.5 14 pontjához képest, de így is messze elmarad a piacvezető Claude Opus 5.5 (Max) 58 pontjától. A teljes súlyok megjelenéséig a cég kiberbiztonsági szakértőkkel, ellenőrzött partnerekkel és állami szervekkel teszteli a modell csökkentett moderációjú, bővített kiberképességű változatát.