2026. augusztus 27., csütörtök · Modellek
Alibaba bemutatta a Qwen3.8-Flash-Next modellt, a Qwen4 előfutárát
Az Alibaba Qwen csapata bemutatta a Qwen3.8-Flash-Next multimodális, mixture-of-experts modellt, amely a jövőbeli Qwen4 architektúrájának előzetese. A modell 125 milliárd paraméterből áll, de tokenenként csak 6 milliárdot aktivál, és tartalmaz egy 51 milliárd paraméteres N-gram beágyazási réteget, amely gyakori szócsoportokat tárol rendszer RAM-ban. A natív kontextusablak 262 144 token, YaRN-nel akár 1 millió tokenig bővíthető. Az Alibaba saját, publikált benchmarkjai szerint a Flash-Next a betanítási költség kilencedéből is jobb eredményeket ér el, mint a Qwen3.7-Plus, és a legtöbb tesztben megelőzi a DeepSeek-V4-Flash és az Anthropic Claude Opus 4.6 modelleket, kivéve a Humanity's Last Exam tesztet. Az éles verzió Qwen3.8-Flash néven érhető el a QwenCloudon, millió bemeneti tokenenként 0,16, millió kimeneti tokenenként 0,47 dollárért.
Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.
Miért fontos?
Az Alibaba nyilvános tesztjei szerint egy jóval kisebb aktív paraméterszámú modell drágább riválisokat előz meg, ami átalakíthatja az AI-fejlesztés költséghatékonysági versenyét.
Források
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. augusztus 27., csütörtök napi AI összefoglaló része.
Helyesbítés · 2026. október 1., csütörtök
Helyesbítés (2026-10-01): az összefoglaló ársávként közölte („millió tokenenként 0,16–0,47 dollárért”) a két külön árat; a forrás szerint 0,16 dollár a bemeneti, 0,47 a kimeneti millió token ára.