2026. július 22., szerda · Modellek

Tudósok értékelik a Kimi K3-at: fordulópontnak tartják a kínai AI-modellt

A Nature cikke szerint kutatók körében komoly visszhangot keltett a Moonshot AI múlt héten bemutatott Kimi K3 modellje. Joel Pearson, az UNSW Sydney kognitív idegtudósa szerint a modell "fordulópontot" jelent, egyesek pedig "Szputnyik-pillanatnak" nevezik. A cég saját tesztjei alapján a K3 kódolásban és táblázatkezelésben felveszi a versenyt amerikai riválisaival. A kereslet miatt a Moonshot AI három nappal a megjelenés után felfüggesztette az új regisztrációkat. Mehwish Nasim, a University of Western Australia AI-kutatója szerint a modell megjelenésének időzítése – az Anthropic Claude Fable 5 és az OpenAI GPT-5.6 debütálása után – azt jelzi, hogy Kína nemcsak élvonalbeli AI-rendszereket kíván építeni, hanem a nemzetközi AI-ökoszisztéma és szabályozás alakításában is részt akar venni.

Miért fontos?

Független kutatók értékelése szerint a Kimi K3 érdemi technológiai lépést jelent a kínai AI számára, ami a nemzetközi erőviszonyok alakulását jelzi.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. július 22., szerda napi AI összefoglaló része.

Kapcsolódó hírek

Kínai nyílt AI-modellek kihívást jelentenek a Szilícium-völgy zárt fejlesztési megközelítésének

Több kínai AI-startup és technológiai óriáscég nyílt súlyú modelleket adott ki, amelyek a harmadik féltől származó teljesítménytesztek szerint megközelítik a legjobb nyugati modellek szintjét, különösen az ágens alapú kódolási feladatokban. A WIRED beszámolója szerint a Fehér Ház tudománypolitikai irodájának igazgatója, Michael Kratsios azt állította, hogy a Moonshot AI az Anthropic Fable modelljének desztillálásával fejlesztette saját K3 modelljét, amit amerikai technológia ellopásának minősített – a Moonshot AI a cikk megjelenéséig nem reagált. A kínai és az amerikai AI-szcéna közötti szakadék mélyül: míg Kínában a nyílt forráskódú megközelítés erősödik, addig az amerikai laborok – részben kormányzati nyomásra – egyre zártabbá válnak. Az Anthropic és az OpenAI is késleltette vagy korlátozta modelljeinek kiadását exportkorlátozások és fehér házi kérések nyomán.

A Moonshot Kimi K3 modellje frontend kódban vezet, de matematikában messze lemarad a nyugati riválisoktól

A Moonshot AI kínai Kimi K3 modellje a Code Arena frontend kód benchmarkján 1679 pontot ért el, ezzel megelőzve a Claude Fable 5-öt (1631) és a GPT-5.6 Sol-t (1618) is – a The Decoder beszámolója szerint ez az első alkalom, hogy kínai modell végzett az élen ezen a teszten. A kép ugyanakkor vegyes: az Epoch AI adatai alapján a Kimi K3 a FrontierMath Tier 4 nehéz matematikai feladatain mindössze 39 százalékos pontosságot ért el, míg az OpenAI és az Anthropic modelljei ugyanezeken a feladatokon egyes esetekben 90 százalék körüli eredményt produkáltak. A két benchmark tehát eltérő területeken mutatja a modell erősségeit és korlátait: a frontend fejlesztésben kiemelkedő, de komplex matematikai problémáknál jelentős a lemaradása.

OpenAI kiadta a GPT-6 Astrát: döcögős indulás, vegyes benchmarkeredmények

Az OpenAI csütörtökön elindította GPT-6 Astra modelljét, „generációs ugrásnak” nevezve, de a bevezetés akadozott: sok fizető Plus és Pro előfizető órákig nem fért hozzá, mert a cég először vállalati ügyfeleket szolgált ki. Sam Altman elnézést kért a „kaotikus” indulásért, és napi egy visszaállítást ígért kártalanításként, amíg a hozzáférés hiányzik. Az OpenAI rendszerkártyája szerint Astra kevesebbet hallucinál elődjénél, a közvetlen prompt-injekciók 99,99 százalékát blokkolja, de tartós, többfordulós támadásokkal még mindig kb. minden harmadik alkalommal kicsikarható belőle problémás válasz, a dokumentumba rejtett indirekt injekciók sikerességi aránya pedig 27-ről 8,5 százalékra csökkent. Az Epoch AI és az Artificial Analysis mérőrendszerei ellentmondó eredményre jutottak Astra teljesítményéről, miközben az ARC-AGI-3 teszten a modell először dolgozott hatékonyabban az átlagembernél.

OpenAI kiadta a GPT-6 Astrát, és „AGI-korszakot” hirdet – de a definíció vitatott

Az OpenAI bemutatta legújabb, GPT-6 Astra nevű modelljét, amelyet a cég a legerősebb, valaha kiadott rendszerének nevez. Greg Brockman elnök szerint elképzelhető, hogy éppen ezzel a modellel érkezett el a mesterséges általános intelligencia (AGI) kora – ez azonban az OpenAI saját, marketingízű állítása, nem független mérés eredménye. A cég szerint az Astra a benchmarkokon felülmúlja saját elődjét és az Anthropic modelljeit is logikában, matematikában és szoftverfejlesztésben, ugyanakkor tokenárai is magasabbak lettek. A The Guardian szerint pár nappal korábban maga Sam Altman az AGI fogalmát „lényegtelen marketingkifejezésnek” nevezte, és a modell tréningjét egy korábbi, nem az Astrához köthető biztonsági incidens miatt ideiglenesen leállították.