2026. július 11., szombat · Eszközök

NVIDIA NeMo pipeline fél millió szintetikus pénzügyi hírfőcímet generált iteratív deduplikációval

Az NVIDIA technikai blogján bemutatott pipeline a NeMo Data Designer, NeMo Curator és Nemotron-3-Nano-30B-A3B modellek kombinálásával 82 iterációban 502 536 egyedi pénzügyi hírfőcímet állított elő 13 kategóriában egyetlen 8×B200 GPU-csomóponton. A munkafolyamat kulcsa a globális szemantikus deduplikáció (90%-os koszinusz-hasonlósági küszöb, 500 K-means klaszter), a centroidtól legtávolabbi példák kiválasztásán alapuló few-shot stratégia és a dinamikus kategória-eloszlás korrekció, amelyek együttesen ~82%-os kumulatív deduplikációs arányt értek el. Az NVIDIA szerint a keletkező FinHeadlineMix adatkészlet ritka pénzügyi események lefedésére is alkalmas, és kompakt tanulómodellek desztillációját, valamint klasszifikációját támogatja, amelyek megközelíthetik a tanármodell F1-teljesítményét pénzügyi NLP-benchmarkokon.

Miért fontos?

Nyilvános, reprodukálható referencia-munkafolyamatot ad szintetikus pénzügyi adatgeneráláshoz, ami enyhítheti a ritka események alulreprezentáltságát.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. július 11., szombat napi AI összefoglaló része.

Kapcsolódó hírek

OpenAI tesztel egy „mindig futó” Codex-ügynök módot

A WIRED által megvizsgált Codex-kódbázisban felfedezett „Persistent mode” nevű beállítás szerint az ügynök a jelenlegi, perceken-órákon belül leálló módokkal szemben „alvó állapotig” futna tovább. A funkcióhoz tartozó „proaktivitás” elem alapján a rendszer a kérés megválaszolása után önállóan újabb feladatokat generálna, munkameneteken átívelve dolgozna, és a felhasználóról szerzett korábbi információk alapján döntene, akár kéretlen üzenetet is küldve. Az OpenAI szóvivője megerősítette a lapnak, hogy a funkciót tesztelik, de azonnali bevezetést nem terveznek; a cég vezetője a nyílt Codex-repót „közös játszótérnek” nevezte. A fejlesztés az OpenAI, az Anthropic és a Meta versenyébe illik a szélesebb közönséget megcélzó, önállóan dolgozó AI-ügynökök terén.

Google AI Mode-ja már repülőjegyet és szállodát is foglal

A Google csütörtökön bejelentette, hogy az AI Mode nevű beszélgetős keresési funkciója mostantól repülőjegy-árakat is figyel és szállodafoglalást is intéz. A vállalat állítása szerint a felhasználók leírhatják, mikor és hova szeretnének utazni, ekkor a rendszer több mint 300 légitársaság és utazási oldal kínálatából mutat aktuális árakat, és kérésre árváltozásról e-mailben is értesít; ez a funkció már 180 országban elérhető. A szállodafoglalás egyelőre az Egyesült Államokban, angol nyelven indul, és a következő hetekben bővül olyan partnerekkel, mint a Booking.com, a Hilton, a Marriott vagy az Expedia, a foglalás Google Pay-jel zárul, de a lebonyolítást és az ügyfélszolgálatot a szálloda vagy a foglalási platform végzi. A Google szerint az AI Mode emellett pontban vagy mérföldben is meg tudja mutatni a repülőjegyek és szállodák árát.

Az AWS bemutatta a SageMaker Python SDK v3-at és annak új script mode-ját

Az AWS hivatalos blogbejegyzése szerint megjelent a SageMaker Python SDK v3, amely alapjaiból újratervezi a script mode funkciót, amelyet a vállalat először 2021-ben mutatott be. Az új verzió a keretrendszer-specifikus estimator osztályokat (SKLearn, PyTorch, XGBoost) egyetlen, egységes ModelTrainer és ModelBuilder osztállyal váltja fel a tanításhoz, illetve a modellek üzembe helyezéséhez. A SourceCode konfigurációs objektum futásidőben szinkronizálja a helyi kódkönyvtárat a tanítási feladatba, így egy Amazon ECR-ből származó konténerkép újraépítése nélkül is módosítható a kód. A bejegyzés két végpontig tartó példát mutat be: egy scikit-learn Random Forest tanítását és üzembe helyezését, valamint a Stable Diffusion 3.5 finomhangolását LoRA technikával, Hugging Face Accelerate segítségével, több GPU-n.

AWS bemutatta az OpenSearch MCP Apps funkcióját az AI-ügynökök ellenőrzéséhez

Az AWS hivatalos blogbejegyzése szerint az Amazon OpenSearch Service új MCP Apps funkciója kiterjeszti a Model Context Protocol-t, így minden eszközhívás interaktív vizualizációval – trace-waterfall diagrammal, szolgáltatástérképpel vagy lognézettel – tér vissza az AI-asszisztens csevegőablakában. A vállalat szerint korábban a megfigyelő ügynökök gyorsan adtak szöveges gyökérok-hipotézist, de a mérnököknek ezt külön böngészőfülön, saját eszközükben kellett manuálisan ellenőrizniük, ami megszakította a vizsgálatot. Az AWS állítása szerint az MCP Apps kiküszöböli ezt az eszközváltást, mivel a szöveges válasz mellé rögtön megjeleníti a releváns irányítópult-widgetet ugyanabban a beszélgetési szálban.