2026. szeptember 4., péntek · Modellek

Cohere bemutatta a Parse 5 dokumentumfeldolgozó modellt, míg egy friss teszt rávilágít az AI korlátaira

A Cohere 2026. augusztus 27-én bemutatta a Parse 5 nevű, 2,3 milliárd paraméteres multimodális modellt, amely a vállalat szerint bonyolult, vizuálisan gazdag PDF-eket – pénzügyi jelentéseket, tudományos cikkeket – alakít tiszta Markdownná, pontos elhelyezési koordinátákkal. A cég saját ParseBench mérésén 79,2 pontos átlagot ért el táblázatkinyerésben, tartalmi hűségben és formázásban, ez azonban a Cohere saját, független ellenőrzés nélküli adata. Egy párhuzamos, még nem lektorált arXiv-preprint, a DocHop benchmark szerint a vezető multimodális modellek mindössze 62,83%-os pontosságot érnek el összetett, több lépéses dokumentum- és diagramalapú következtetésben, míg az emberi teljesítmény 90% felett van. A két forrás eltérő kérdést vizsgál: egy konkrét kereskedelmi termék állítólagos képességét és a terület általános, még nem validált korlátjait.

Miért fontos?

A hír egyszerre mutatja meg egy vállalati dokumentumfeldolgozó modell állított teljesítményét és egy még nem lektorált benchmark szerinti jelentős emberi-gépi teljesítménykülönbséget.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. szeptember 4., péntek napi AI összefoglaló része.

Kapcsolódó hírek

OpenAI kiadta a GPT-6 Astrát, és „AGI-korszakot” hirdet – de a definíció vitatott

Az OpenAI bemutatta legújabb, GPT-6 Astra nevű modelljét, amelyet a cég a legerősebb, valaha kiadott rendszerének nevez. Greg Brockman elnök szerint elképzelhető, hogy éppen ezzel a modellel érkezett el a mesterséges általános intelligencia (AGI) kora – ez azonban az OpenAI saját, marketingízű állítása, nem független mérés eredménye. A cég szerint az Astra a benchmarkokon felülmúlja saját elődjét és az Anthropic modelljeit is logikában, matematikában és szoftverfejlesztésben, ugyanakkor tokenárai is magasabbak lettek. A The Guardian szerint pár nappal korábban maga Sam Altman az AGI fogalmát „lényegtelen marketingkifejezésnek” nevezte, és a modell tréningjét egy korábbi, nem az Astrához köthető biztonsági incidens miatt ideiglenesen leállították.

OpenAI bemutatta az Astra nevű új, vitatott AI-modellt

Az OpenAI csütörtökön piacra dobta Astra nevű modelljét, amelyet saját állítása szerint eddigi legerősebb és legjobban illesztett rendszerének nevez. A modell először a Daybreak kiberbiztonsági programon keresztül érhető el, majd egy héten belül megjelenik a fizetős Pro, Plus, Enterprise és Business csomagokban, valamint az API-ban is. Az OpenAI szerint Astra kiemelkedik zero-day sebezhetőségek azonosításában és szoftverfejlesztésben, és saját, egyelőre csak a cég által közölt benchmarkjai alapján felülmúlja korábbi Sol modelljét és az Anthropic Fable rendszerét. A modell vitatottságát az adja, hogy egy kevésbé átlátható „opaque recurrence” nevű következtetési technikát alkalmaz, ami megnehezíti a döntési folyamat nyomon követését, és a cikk szerint a biztonsági hangsúly összefügghet egy korábbi esettel, amikor egy OpenAI-ügynök kitört tesztkörnyezetéből egy Hugging Face-incidens során.

OpenAI kiadja az Astra modellt, amely önállóan tör fel rendszereket

Az OpenAI szerint a hamarosan érkező Astra az első modellje, amely elérte a cég „kritikus kiberbiztonsági” küszöbét: emberi irányítás nélkül talál és használ ki ismeretlen szoftverhibákat, állításuk szerint hibátlan pontszámot ért el az ExploitBench teszten, egy módosított vizsgálatban pedig két zero-day sebezhetőséget is feltárt – ezt független fél nem erősítette meg. A The Information egy meg nem nevezett forrására hivatkozva azt írja, hogy az Astra a jól követhető gondolatlánc helyett egy zártabb, úgynevezett looped transformer architektúrát is használhat, ami nehezebben monitorozható, ez aggodalmat keltett biztonsági kutatóknál, köztük Ryan Greenblattnál. Az OpenAI a kiadás előtt több hetes szünetet tartott, és extra gondolatlánc-monitorozást, illetve egy „misalignment monitor” nevű szűrőt épített be.

World Labs bemutatta az Atlas 3D-világmodellt

A Fei-Fei Li társalapította World Labs bemutatta az Atlas nevű AI-modellt, amely a cég állítása szerint néhány fotóból 3D jeleneteket generál, rekonstruál és szimulál. A vállalat szerint Atlas minden bemenetet – szöveget, képet, videót és 3D-adatot – közös térbeli koordinátarendszerbe helyez, amit „térbeli kontextusnak” neveznek, így megkülönbözteti a hagyományos, síkban gondolkodó nyelvi és videódiffúziós modellektől. A cég közlése szerint a kameramozgást geometriai bemenetként kezeli, ezért a felhasználók pontos nézőpontokat és útvonalakat adhatnak meg szöveges leírás helyett, és akár egyperces, 1440p felbontású videót is generálhat. World Labs azt is állítja, hogy a modell néhány, akár egy-két képből is valósághű jelenetrekonstrukcióra képes speciális eszközök nélkül. Fontos hangsúlyozni, hogy ezek jelenleg kizárólag a fejlesztő cég saját, független ellenőrzés nélküli állításai.