2026. augusztus 2., vasárnap · Eszközök

AI-ügynökök felturbózzák a tudományos szoftvereket, de a hibákat nem tudják kiszűrni

Az OpenAI és akadémiai partnerei közös terepjelentése nyolc esettanulmányt mutat be, amelyekben kutatócsoportok Codex és Claude Code kódoló ügynökökkel modernizítottak elavult, kutatásokhoz készült szoftvereket, főként biológiai területen. A projektek egyszerű build-frissítésektől (cyvcf2) teljes átírásokig terjedtek: a MHCflurry immunológiai modellt TensorFlow-ból PyTorch-ra portálták, a STAR szekvenciaillesztő programot Rust nyelven építették újjá, a RustQC pedig 15 minőségellenőrző eszközt vont egyetlen programba, akár 60-szoros sebességnövekedést elérve. A jelentés szerint a rustar-aligner az eredeti STAR eredményeivel 99,8 százalék felett egyezett a tesztelt szekvenciaadatokon. A beszámoló hangsúlyozza: a munka nagy része nem a kódírásból, hanem az eredmények emberi ellenőrzéséből áll, mivel az ügynökök nem tudják megítélni, hogy a tudományos következtetés helyes-e.

Miért fontos?

A tanulmány szerint az AI-ügynökök meggyorsíthatják a kutatási infrastruktúra karbantartását, de a tudományos helyesség ellenőrzése továbbra is emberi feladat marad.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 2., vasárnap napi AI összefoglaló része.

Kapcsolódó hírek

Az OpenAI minden amerikai felhasználó számára elérhetővé tette a ChatGPT Health egészségügyi funkcióját

Az OpenAI csütörtökön az Egyesült Államokban minden 18 éven felüli, bejelentkezett ChatGPT-felhasználó számára megnyitotta a ChatGPT Health funkciót, amely lehetővé teszi egészségügyi adatok – többek között orvosi dokumentumok, laboreredmények, gyógyszerlisták, valamint az Apple Health, a MyFitnessPal és más szolgáltatások adatainak – összekapcsolását a chatbottal. A The Verge beszámolója szerint az OpenAI egészségügyi alelnöke azt állította, hogy modelljeik a klinikusok szintjét meghaladó következtetési képességgel rendelkeznek, ugyanakkor a cég egészségügyi vezetője ezt árnyalta, mondván, hogy egyes tanulmányok mutatnak ebbe az irányba. A funkció bevezetésével egy időben egy floridai lelkész pert indított az OpenAI ellen, azt állítva, hogy a ChatGPT veszélyes orvosi tanácsot adott neki. Az OpenAI hangsúlyozza, hogy a szolgáltatás a szakorvosi ellátást támogatja, nem helyettesíti.

Az OpenAI bemutatta a GPT-Red nevű kibervédelmi mesterséges intelligenciát

Az OpenAI kifejlesztett egy GPT-Red nevű nagy nyelvi modellt, amelyet a vállalat saját rendszereinek biztonsági tesztelésére használ. A rendszer automatizálja az úgynevezett red-teaming folyamatot, amelyet korábban emberi tesztelőcsapatok végeztek: célja, hogy minél többféle módon feltárja a szoftverrendszerek sebezhetőségeit és támadási felületeit. Az MIT Technology Review exkluzív betekintést kapott a rendszerbe, amely az OpenAI szerint segíthet a vállalatnak a kibertámadókkal szembeni előnye megőrzésében. A GPT-Red lényegében egyfajta automatizált szuperhackerként működik, amely küzdőtársként edzi a cég többi modelljét a védekezésben.

Az OpenAI első hardverterméke egy 230 dolláros programozó-billentyűzet, a Codex Micro

Az OpenAI a Work Louder billentyűzetgyártóval közösen bemutatta első márkázott hardvereszközét, a Codex Micro nevű mini billentyűzetet, amely 230 dollárba kerül és korlátozott példányszámban érhető el. A The Verge és az Ars Technica beszámolói szerint az eszköz hat áttetsző, RGB-világítású gombot tartalmaz, amelyek színkódokkal jelzik a Codex kódolóplatform párhuzamosan futó ágens-szálainak állapotát – fehér az inaktív, kék a gondolkodás, zöld a kész, sárga az emberi beavatkozást igénylő, piros a hibás feladatot jelöli. A készülék emellett hat programozható parancsgombot, joysticket, tárcsát és érintésérzékelőt kínál, valamint 32 cserélhető billentyűsapkát tartalmaz. Az eszköz a ChatGPT asztali alkalmazásból konfigurálható, és elkülönül az OpenAI Jony Ive-vel közösen fejlesztett, eddig be nem mutatott okoshangszóró-projektjétől.

Google visszavonta a Google Earth hamis műholdképeket készítő AI-eszközét

A Google július 30-án építette be a Google Earth alkalmazásba a Nano Banana 2 képgeneráló AI-t, amellyel bárki valósághűnek tűnő, módosított műholdfelvételeket készíthetett a szolgáltatás valódi képeiből. A funkciót két nap múlva visszavonták, miután felhasználók olyan hamis jeleneteket osztottak meg, mint egy bombázott gázai kórház, egy menekültoszlop a mexikói határon, vagy egy óriási aranyszobor a Fehér Ház felett. A Google szerint a képeket AI-generáltként jelölték és mások számára nem voltak láthatók az appon belül, mégis kerültek nyilvánosságra szabálysértő képernyőképek. A vállalat közlése alapján a funkció csak erősebb védőintézkedésekkel térhet vissza. Biztonsági szakértők, köztük a Bellingcat alapítója, arra figyelmeztettek, hogy az eszköz alááshatja a Google Earth mint konfliktusövezeti bizonyítékok hitelesítésére használt forrás megbízhatóságát.