2026. szeptember 3., csütörtök · Modellek
World Labs bemutatta az Atlas 3D-világmodellt
A Fei-Fei Li társalapította World Labs bemutatta az Atlas nevű AI-modellt, amely a cég állítása szerint néhány fotóból 3D jeleneteket generál, rekonstruál és szimulál. A vállalat szerint Atlas minden bemenetet – szöveget, képet, videót és 3D-adatot – közös térbeli koordinátarendszerbe helyez, amit „térbeli kontextusnak” neveznek, így megkülönbözteti a hagyományos, síkban gondolkodó nyelvi és videódiffúziós modellektől. A cég közlése szerint a kameramozgást geometriai bemenetként kezeli, ezért a felhasználók pontos nézőpontokat és útvonalakat adhatnak meg szöveges leírás helyett, és akár egyperces, 1440p felbontású videót is generálhat. World Labs azt is állítja, hogy a modell néhány, akár egy-két képből is valósághű jelenetrekonstrukcióra képes speciális eszközök nélkül. Fontos hangsúlyozni, hogy ezek jelenleg kizárólag a fejlesztő cég saját, független ellenőrzés nélküli állításai.
Miért fontos?
Ha a World Labs állításai igazolódnak, jelentős lépés lehet a térbeli, 3D-tudatos AI-modellek felé, amelyek meghaladhatnák a hagyományos videó- és nyelvi modellek korlátait.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. szeptember 3., csütörtök napi AI összefoglaló része.