2026. szeptember 2., szerda · Modellek

Runway bemutatta a Solaris nevű, valós idejű felületgeneráló AI-t

A Runway bemutatta a Solaris nevű rendszert, amely a cég állítása szerint az általa „Interface World Model” néven elnevezett új kategória első tagja: nem kódot futtat, hanem képkockánként rendereli a felhasználói felületet, és valós időben reagál kattintásra, húzásra vagy hangparancsra. A Gen-4.5 videómodellre épülő Solaris 720p felbontásban jelenít meg interfészeket, és Runway szerint alkalmas lehet interaktív vásárlásra, bútor- és lakberendezési vizualizációra, valamint vizuális oktatóanyagokra. A cég állítása szerint célja, hogy a rögzített alkalmazások helyett a felhasználóhoz igazodó, dinamikus felületek jöjjenek létre, és egyben AI-ágensek betanítására is alkalmas eszköznek tekinti. Fontos korlátozás, hogy a szöveg megjelenítése még hibás, nincs képernyőolvasó-támogatás, ezért Runway maga is kutatási projektnek nevezi a rendszert.

Miért fontos?

A fejlesztés azt jelzi, hogy egy vezető AI-videócég a hagyományos, kódalapú szoftverfelületek helyett valós időben generált interfészekkel kísérletezik, ami hosszabb távon átalakíthatja az alkalmazások működését.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. szeptember 2., szerda napi AI összefoglaló része.

Kapcsolódó hírek

Az AWS elérhetővé tette a Claude Fable 5.1 modellt

Az AWS bejelentése szerint a Claude Fable 5.1 elérhető az Amazon Bedrocken és a Claude Platform on AWS szolgáltatáson keresztül. Az Anthropic állítása szerint a modell a legnehezebb érvelési teszteken – köztük versenymatematikai és tudományos feladatokon – jobban teljesít, mint elődje, a Fable 5, és megbízhatóbb a kódolási, kutatási és vállalati munkafolyamatokban. Mivel az Anthropic „Covered Model” kategóriába sorolta, a modellre kiterjesztett adatmegőrzési (akár 30 napos), biztonsági felülvizsgálati és hozzáférési szabályok vonatkoznak. Az Anthropic emellett bemutatta az „Enterprise Frontier Safeguards” nevű megoldást, amely a vállalatnak lehetőséget ad a legfejlettebb modellek használatára úgy, hogy adataik saját felügyelt felhőinfrastruktúrájukban maradjanak. A közlemény kizárólag az AWS és az Anthropic saját állításait tartalmazza, független teljesítménymérés nem szerepel benne.

Google bemutatta a Gemini 3.5 Transcribe beszédfelismerőt

A Google elindította a Gemini 3.5 Transcribe nevű valós idejű beszéd-szöveg átalakító modelljét, amely a vállalat szerint automatikusan felismer több mint 85 nyelvet, kiszűri a töltelékszavakat, javítja a nyelvbotlásokat, és önállóan formázza a szöveget. Google állítása szerint a szóhiba-arány streamelt hangnál 4,0, rögzített hangnál 2,6 százalék, a késleltetés pedig 70 százalékkal alacsonyabb az elődjéhez, a Chirp 3-hoz képest. A modell function calling funkción keresztül más Gemini-modelleknek adhat tovább feladatokat, például képgenerálást vagy webes keresést. Két felülettel érhető el: a Live API valós idejű streameléshez, az Interactions API pedig rögzített hanganyagok feldolgozásához beszélő-azonosítással és időbélyegekkel. A Google szerint már elérhető az AI Studio-ban, a Gemini Enterprise platformon, Androidon és macOS-en, Chrome-támogatás hamarosan jön.

Alibaba bemutatta a Qwen3.8-Flash-Next modellt, a Qwen4 előfutárát

Az Alibaba Qwen csapata bemutatta a Qwen3.8-Flash-Next multimodális, mixture-of-experts modellt, amely a jövőbeli Qwen4 architektúrájának előzetese. A modell 125 milliárd paraméterből áll, de tokenenként csak 6 milliárdot aktivál, és tartalmaz egy 51 milliárd paraméteres N-gram beágyazási réteget, amely gyakori szócsoportokat tárol rendszer RAM-ban. A natív kontextusablak 262 144 token, YaRN-nel akár 1 millió tokenig bővíthető. Az Alibaba saját, publikált benchmarkjai szerint a Flash-Next a betanítási költség kilencedéből is jobb eredményeket ér el, mint a Qwen3.7-Plus, és a legtöbb tesztben megelőzi a DeepSeek-V4-Flash és az Anthropic Claude Opus 4.6 modelleket, kivéve a Humanity's Last Exam tesztet. Az éles verzió Qwen3.8-Flash néven érhető el a QwenCloudon, millió tokenenként 0,16–0,47 dollárért.

Z.ai áll a rejtélyes Ox Alpha modell mögött

Hétvégén sokat találgattak, melyik AI-labor készítette az OpenRouteren névtelenül feltűnt, benchmarkokon élen járó Ox Alpha nyílt súlyú modellt. A TechCrunch szerint a Bloomberg értesülésére hivatkozva a GLM-sorozatot jegyző Z.ai áll mögötte, amit a cég meg is erősített: Ox Alpha a GLM-család legújabb tagja. A Z.ai szerint a modell kódolásra, hosszan tartó ágensi munkára és éles üzemi feladatokra tervezett rendszer, amely komplex, hosszú távú szoftverfejlesztési munkát és vizuális kontextussal kombinált feladatokat is kezel. A cég a modell súlyait szerdán teszi közzé, ezután a fejlesztők építhetnek rá. A TechCrunch szerint az olcsó, versenyképes kínai modellek – köztük a korábban bemutatott GLM-5.3, amely egyes benchmarkokon az Anthropic Fable 5 modelljével vetekszik – piaci részesedést vehetnek el az olyan drága, élvonalbeli cégektől, mint az OpenAI és az Anthropic.