2026. július 30., csütörtök · Eszközök

NVIDIA GPU-alapú fizikai szimulációt épít egészségügyi robotokhoz

Az NVIDIA saját blogbejegyzésében bemutatta a Medical Physics Simulation keretrendszert, amely az Isaac for Healthcare platform része, és GPU-natív, moduláris szimulációs környezeteket kínál orvosi robotok fejlesztéséhez. A vállalat állítása szerint az endoluminális és sebészeti modulok valós idejű, nagy pontosságú eszköz-anatómia modellezést tesznek lehetővé Warp, Newton Physics és CUDA felhasználásával, célként a klinikai adathiány pótlását megjelölve, mivel a valós demonstrációk száma jellemzően csak néhány száz. Az NVIDIA szerint a Cosmos-H generatív világmodell integrálásával szintetikus adatok és akció-feltételes videó-előrejelzés is előállítható. A leírás kizárólag vállalati technikai blogbejegyzésen alapul, független megerősítés vagy klinikai validáció nem szerepel a forrásban.

Miért fontos?

A hír azért fontos, mert az NVIDIA konkrét technológiai megoldást kínál az egészségügyi robotika egyik legnagyobb korlátjára, a valós klinikai adatok szűkösségére.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. július 30., csütörtök napi AI összefoglaló része.

Kapcsolódó hírek

NVIDIA PAIR: helyi hálózaton osztja el az AI-feladatokat

Az NVIDIA bejelentése szerint béta állapotban elérhető a Personal AI Router (PAIR), amely a helyi hálózaton lévő több gép számítási kapacitását vonja össze, és automatikusan szétosztja köztük az AI-kéréseket. A vállalat célja elsősorban a többügynökös (multi-agent) munkafolyamatok támogatása, ahol egyetlen GPU-t túlterhelhetnek a párhuzamos modellhívások; PAIR ezt proxyként kezeli, és a bejövő kérést a megfelelő csomópontra irányítja anélkül, hogy az ügynöknek vagy a mögöttes architektúrának változnia kellene. NVIDIA saját demója szerint egy Hermes Desktop–Ollama–PAIR kombináció, amely RTX Spark, DGX Spark és RTX 5090 gépeket kapcsolt össze, körülbelül kétszeres gyorsulást ért el egyetlen RTX Spark laptophoz képest, ám a cég hangsúlyozza, hogy ez nem teljesítménygarancia, mert az eredmény a munkaterheléstől, a modelltől és a hálózattól is függ. A PAIR zökkenőmentesen illeszkedik olyan meglévő helyi inferenciaszolgáltatásokhoz, mint az Ollama és az LM Studio, és Windows 11, Linux, valamint macOS alatt, x64 és arm64 architektúrán egyaránt használható.

Amazon Bedrock: természetes nyelvű videókeresés a Marengo 3.0 modellel

Az AWS hivatalos bejegyzése szerint elérhetővé vált a TwelveLabs Marengo Embed 3.0 beágyazó modell az Amazon Bedrock Knowledge Bases szolgáltatásban. A modell videót, hangot, képet és szöveget kódol egyetlen, 512 dimenziós vektortérbe, így természetes nyelvű lekérdezésekkel kereshető jelentés alapján a videótartalom, például egy adott mozzanat egy több órás felvételben. A vállalat állítása szerint a Bedrock Knowledge Bases kezelt módon végzi a szegmentálást, a képkockakinyerést és az átiratkészítést, így a felhasználóknak nem kell külön transzkripciós szolgáltatásokat, beágyazó modelleket és vektoradatbázisokat összekapcsolniuk. Az AWS bemutatóban egy 2022-es FIFA világbajnoki döntő 10 perces klipjén demonstrálják a funkciót, S3-tárolóból történő feltöltéssel és a Bedrock konzolon keresztüli lekérdezéssel.

Meta elindította Muse személyes AI-ügynökét

A Meta elindította Muse nevű személyes AI-ügynökét iOS-en, Androidon, a Muse.ai weboldalon és WhatsAppon keresztül; a fejlesztést a Meta Superintelligence Labs egység végezte. A WIRED szerint a Muse természetes nyelvű utasítások alapján önállóan küld e-maileket, foglal utazást vagy segít autót eladni, a vásárlásokat pedig a Stripe Link egyszer használatos virtuális kártyaszámaival intézi – a Meta állítása szerint ez az első ilyen ügynök, amelyre kiterjed e vásárlói védelem. Az alapszintű használat ingyenes, a sok feladat automatizálásához előfizetés kell, a biztonságot a Secure VM architektúra garantálja, amely elkülöníti a felhasználói adatokat a nem megbízható webes tartalmaktól.

OpenAI bemutatta a ChatGPT Images 2.5 képmodelleket és a Sketch rajzeszközt

Az OpenAI kedden bevezette a ChatGPT Images 2.5-öt, amely a vállalat állítása szerint természetesebb megvilágítást, gazdagabb textúrákat és pontosabb, több lépésen át követhető szerkesztést kínál. Az új Sketch funkcióval a felhasználók @Sketch paranccsal saját rajzukból kérhetnek részletes AI-képet, és közvetlenül a kép egyes részeire is hagyhatnak megjegyzést a módosításokhoz. Az OpenAI szerint a képgenerálási késleltetés a korábbi Images 2.0-hoz képest akár 50 százalékkal csökkent. A fejlesztők számára két API-modell is elérhető: a gyorsabb, alapértelmezett GPT-Image-2.5 Flare és a részletesebb, lassabb GPT-Image-2.5 Sunburst, mindkettő azonos token-áron, de eltérő tényleges költséggel. A Decoder szerint a ChatGPT Images és a GPT-Image modellek heti szinten már több mint 3 milliárd képet generálnak.