2026. augusztus 12., szerda · Eszközök

NVIDIA NeMo Switchyard: modellek közötti terheléselosztó AI-ügynökökhöz

Az NVIDIA a NeMo Switchyard nevű eszközt ismertette, amely az AI-ügynökök feladatait dinamikusan osztja el különböző méretű és képességű nyelvi modellek között, a feladat jellege, a költség és az infrastruktúra alapján. A vállalat közlése szerint a rendszer szolgáltatófüggetlen SDK-t biztosít, automatikus és testre szabható útválasztási algoritmusokat támogat, és elválasztja az útválasztási logikát a konkrét modellszolgáltatóktól. Az NVIDIA saját tesztjei és a LangChain, illetve a Cognition partnerekkel végzett kipróbálás szerint az útválasztás jelentősen csökkentheti a költségeket a pontosság megtartása mellett, ám ezek az adatok a vállalat saját közléséből származnak, független megerősítés nélkül. A cél, hogy egyetlen nagy, drága modell helyett feladatonként a legmegfelelőbb modellt használják.

Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.

Miért fontos?

A modellek közötti okos terheléselosztás gyakorlati megoldást adhat az AI-ügynökök egyik legnagyobb üzemeltetési problémájára: a költség és a pontosság közötti egyensúlyra.

Források

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 12., szerda napi AI összefoglaló része.

Kapcsolódó hírek

OpenAI bemutatta a Dots nevű AI-ügynök platformot

Az OpenAI a héten jelentette be új AI-ügynök platformját, a Dots-ot, amely blobszerű, elnevezhető avatarokkal dolgozik, és egy virtuális géppel fér hozzá olyan alkalmazásokhoz, mint a Blender vagy a GIMP. A felhasználó egyelőre csak egy Dot-ot kaphat, de a cég ígérete szerint a jövőben több is indítható lesz. A The Verge tesztje szerint a Dot sikeresen megtalált egy 100 dolláros promóciós kedvezményt egy törölt e-mailben egy internetszolgáltatónál történő időpontfoglaláshoz, de elakadt egy emberi ellenőrzésnél, egy hosszan tartandó egérgombnyomásnál, amit a tesztelőnek kellett manuálisan elvégeznie. Az OpenAI a Dots funkciót elsőként a legmagasabb szintű, havi 100 dolláros Pro-előfizetőknek teszi elérhetővé, szemben a Meta ingyenes Muse és Instinct nevű ügynökeivel.

Figma: AI-ügynökök gyorsítják a biztonsági riasztások kivizsgálását

A Figma mérnökcsapata saját beszámolója szerint AI-ügynököket épített biztonsági csapata számára, amelyek riasztásokat vizsgálnak ki, korábbi incidenseket keresnek vissza, rendszereket ellenőriznek, és kódjavításokat is előkészítenek. A rendszer Panther SIEM-re épül, az AWS, Okta, GitHub, GCP és osquery mellett száznál több forrást kérdez le, emellett AWS Bedrock Knowledge Bases, Amazon Kendra, Tines és Snowflake-alapú eszközöket is használ. A Figma állítása szerint ez mintegy 70 százalékkal csökkentette az összetett riasztások megoldási idejét, és 20 százalékkal kevesebb ügyeleti riasztást eredményezett. A cikk szerint a rendszer memóriája – korábbi esetek, viselkedési útmutatók, megtanult adatbázis-struktúrák – kulcsszerepet játszott, miközben emberi felülvizsgálat és beépített korlátok, például az alapból piszkozatként létrejövő kódjavaslatok, biztosítják a biztonságot.

AWS: nyílt forráskódú AI-ügynök vezérli a SageMaker HyperPod klasztereket

Az AWS bemutatta a HyperPod InstantStart nevű nyílt forráskódú vezérlőréteget, amely az Amazon SageMaker HyperPod klaszterek – gépi tanulási modellek futtatására szolgáló, Amazon EKS-re épülő infrastruktúra – beállítását és napi üzemeltetését automatizálja. A vállalat állítása szerint a rendszer egyetlen, a felhasználó AWS-fiókjában futó menedzsment-konténerként működik, és ugyanazt a háttér-API-t szolgálja ki webes felületen és parancssoron keresztül is. Az AWS szerint egy AI-ügynök tervezi meg és futtatja a többlépcsős folyamatot – hálózat, tárhely, azonosságkezelés, node-helyreállítás, modellkiszolgálás –, és csak az elérhetőségi zóna vagy a példánytípus kiválasztásánál áll meg döntésre várva. A cég szerint a megbízhatóság kulcsa, hogy a működési szabályokat egy vezérlőréteg API-jába kódolják, nem pedig nyers parancssori hozzáférést adnak az ügynöknek.

OpenClaw 2.0: egyszerűbb telepítés és közös munkamenetek a nyílt forráskódú AI-ügynöknek

Az OpenClaw fejlesztői kiadták a nyílt forráskódú személyes AI-ügynök 2.0-s verzióját (jelölése: 2026.8.1), amelyet a projekt közleménye szerint 933 fejlesztő több mint 16 ezer pull requestje formált. A gyártó állítása szerint a telepítés leegyszerűsödött: a program automatikusan felismeri a gépen elérhető ChatGPT- vagy Claude-előfizetéseket, API-kulcsokat és helyben futó modelleket, a további beállítást pedig az ügynökkel folytatott beszélgetésbe helyezték át. A böngészős felület is elsődleges kezelőfelületté vált, ahonnan a felhasználó közvetlenül társaloghat az ügynökkel és nyomon követheti a futó feladatokat. Új elem a megosztott felhős munkamenet, amely lehetővé teszi, hogy több felhasználó dolgozzon egy közös ügynök-kontextuson. A rendszer modellfüggetlen marad, és támogatja a WhatsApp, Telegram, Discord, Slack, Signal és iMessage csatornákat.