2026. július 20., hétfő · Modellek

Az Alibaba bemutatta a 2,4 billió paraméteres Qwen 3.8 modellt, célkeresztben a Kimi K3

Az Alibaba nyilvánosságra hozta legújabb, nyílt súlyú Qwen 3.8 modelljét, amely a vállalat állítása szerint 2,4 billió paraméterrel rendelkezik, és csak a Fable 5 mögött marad el. A csapat szerint ez az első, egybillió paraméternél nagyobb multimodális modelljük, amely képeket, videókat és dokumentumokat is feldolgoz. Független benchmark-eredmények egyelőre nem állnak rendelkezésre, a teljesítményállítások kizárólag a fejlesztő közlésén alapulnak. Az előnézet az Alibaba platformjain a szokásos ár tizedéért érhető el, a nyílt súlyok közzétételét a közeljövőre ígérik. A The Decoder szerint a lépés részben a Moonshot AI Kimi K3 modelljének térnyerését célozza ellensúlyozni.

Miért fontos?

A nyílt súlyú óriásmodellek kínai versenye élesedik, ami a globális nyílt forráskódú AI-ökoszisztémára is hatással lehet.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. július 20., hétfő napi AI összefoglaló része.

Kapcsolódó hírek

Alibaba bemutatta a Qwen3.8-Flash-Next modellt, a Qwen4 előfutárát

Az Alibaba Qwen csapata bemutatta a Qwen3.8-Flash-Next multimodális, mixture-of-experts modellt, amely a jövőbeli Qwen4 architektúrájának előzetese. A modell 125 milliárd paraméterből áll, de tokenenként csak 6 milliárdot aktivál, és tartalmaz egy 51 milliárd paraméteres N-gram beágyazási réteget, amely gyakori szócsoportokat tárol rendszer RAM-ban. A natív kontextusablak 262 144 token, YaRN-nel akár 1 millió tokenig bővíthető. Az Alibaba saját, publikált benchmarkjai szerint a Flash-Next a betanítási költség kilencedéből is jobb eredményeket ér el, mint a Qwen3.7-Plus, és a legtöbb tesztben megelőzi a DeepSeek-V4-Flash és az Anthropic Claude Opus 4.6 modelleket, kivéve a Humanity's Last Exam tesztet. Az éles verzió Qwen3.8-Flash néven érhető el a QwenCloudon, millió tokenenként 0,16–0,47 dollárért.

Alibaba kiadta a nyílt súlyú Qwen3.8 modellcsaládot

Alibaba Qwen csapata nyílt súlyú Qwen3.8 modelleket adott ki Apache 2.0 licenc alatt. A fő modell, a Qwen3.8-27B, 27 milliárd paraméteres multimodális modell, amely a fejlesztő állítása szerint kódolási és irodai feladatokban felülmúlja a nagyobb Qwen3.7-Plus modellt, és önállóbban tervez, megbízhatóbban hajt végre ügynöki feladatokat. Natívan kezel akár 262 000 tokenes kontextust, a YaRN módszerrel pedig egymillió tokenig skálázható, emellett képeket és videókat is feldolgoz, beleértve diagramokat és többórás videókat. Megjelent egy jóval nagyobb, Qwen3.8-2.4T-A95B jelű, Max szintű modell súlya is; mindkettő elérhető a Hugging Face-en és a ModelScope-on, egymillió tokenes kontextussal hamarosan a Qwen Cloud szolgáltatáson keresztül is elérhető lesz.

Alibaba bemutatta a Qwen3.8-Max modellt, kihívást intézve az amerikai AI-vezetők felé

Az Alibaba hétfői blogbejegyzésében bemutatta a Qwen3.8-Max nyelvi modellt, amelyet saját állítása szerint eddigi legnagyobb és legképzettebb rendszerének nevez. A cég szerint a teljesítménye vetekszik az Anthropic vezető modelljével (a forrásban Fable 5 néven szereplő rendszerrel), az OpenAI fejlesztéseivel, és a hazai Moonshot AI Kimi K3 modelljével is. Az Alibaba saját tesztjei és a nyilvános Arena.AI rangsor szerint a szöveges modellek listáján csak Fable 5 és három Claude Opus-modell előzi meg. A vállalat közlése szerint a modell 2,4 billió paraméterrel rendelkezik, és a súlyokat jövő héten nyílt formában teszik elérhetővé, visszatérve a korábban felfüggesztett nyílt hozzáférésű gyakorlathoz. A kínai nyílt modellek térnyerése tovább fokozza a Szilícium-völgy és Washington közötti feszültséget az AI-technológiai fölény kérdésében.

OpenAI kiadja az Astra modellt, amely önállóan tör fel rendszereket

Az OpenAI szerint a hamarosan érkező Astra az első modellje, amely elérte a cég „kritikus kiberbiztonsági” küszöbét: emberi irányítás nélkül talál és használ ki ismeretlen szoftverhibákat, állításuk szerint hibátlan pontszámot ért el az ExploitBench teszten, egy módosított vizsgálatban pedig két zero-day sebezhetőséget is feltárt – ezt független fél nem erősítette meg. A The Information egy meg nem nevezett forrására hivatkozva azt írja, hogy az Astra a jól követhető gondolatlánc helyett egy zártabb, úgynevezett looped transformer architektúrát is használhat, ami nehezebben monitorozható, ez aggodalmat keltett biztonsági kutatóknál, köztük Ryan Greenblattnál. Az OpenAI a kiadás előtt több hetes szünetet tartott, és extra gondolatlánc-monitorozást, illetve egy „misalignment monitor” nevű szűrőt épített be.