2026. augusztus 15., szombat · Üzlet

Francia startup szoftveres trükkökkel gyorsítaná a GPU-alapú AI-következtetést

A francia Kog startup azt állítja, hogy szoftveres optimalizálással jelentősen felgyorsítható az AI-következtetés meglévő adatközponti GPU-kon, például AMD MI300X és Nvidia H200 kártyákon. Májusi technológiai bemutatójuk a Hacker News címlapjára is felkerült, és a vezérigazgató, Gaël Delalleau szerint azóta mintegy 200 konkrét üzleti érdeklődő jelentkezett. A demóban 3000 token/másodperc sebességet értek el, de ezt egy célzottan épített, mindössze 2 milliárd paraméteres kis modellel, a Laneformer 2B-vel mutatták be, amelyet azóta nyílt forráskódúvá tettek. A cég szerint ugyanez a módszer nagy nyelvi modelleknél is működne, ez azonban egyelőre igazolatlan ígéret, mivel az erre optimalizált verzió még fejlesztés alatt áll. Az összefoglaló kizárólag a Kog és vezetője állításain alapul, független mérés nem szerepel a forrásban.

Egy forrás Ehhez a hírhez egy forráslink áll rendelkezésre.

Miért fontos?

Ha a Kog állítása igazolódik, olcsóbbá és gyorsabbá válhat az AI-modellek futtatása a meglévő GPU-flottákon, csökkentve a drága célhardver iránti igényt.

Források

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 15., szombat napi AI összefoglaló része.

Kapcsolódó hírek

Otthoni szervereket bérelnek AI-inferenciára új cégek

Az IEEE Spectrum cikke szerint új startupok, köztük a Far Labs (Far AI, Abu Dhabi) és az Evolving Edge (Austin, Texas), otthoni szervereket, gamer gépeket és laptopokat bérelnek ki AI-inferenciára, azaz betanított modellek futtatására. A cégek állítása szerint az Uber vagy Airbnb logikáját alkalmazzák: a kihasználatlan gépeket kötik össze, hogy nyílt forráskódú, kisebb modelleket futtassanak rajtuk, a tulajdonosoknak pedig fizetnek ezért. A cikk megemlíti, hogy hasonló szolgáltatást nyújt már a Bless Network, a Salad és a Gradient is. A vállalatvezetők szerint ez alternatívát kínálhat a nagy adatközpontokkal szemben, amelyek megterhelik a helyi közösségeket áram- és vízfelhasználással. Az állítások jelenleg a cégek saját kommunikációján alapulnak, független adat a tényleges elterjedtségről vagy hatékonyságról a cikkben nem szerepel.

Dél-Korea 3,49 milliárd dollárt szán saját frontier AI-modellre

Dél-Korea kormánya a 2027-es költségvetési javaslat részeként 4,7 billió won, azaz mintegy 3,49 milliárd dolláros állami tőkebefektetést tervez egy hazai fejlesztésű, Kína legjobb nyílt modelljeivel versenyképes AI-rendszer létrehozására, bár a parlamentnek még jóvá kell hagynia a tervet. Egy második finanszírozási csatorna a koreai modellek hazai gazdasági alkalmazását támogatná. A jelenlegi versenyben LG AI Research, SK Telecom és Upstage versenyeznek, de a kormány nyílt pályázatot indít, amelybe start-upok is beszállhatnak, és a mostani két döntős nem kap automatikusan további forrást. Tisztviselők szerint Korea nem tud versenyezni a legnagyobb amerikai cégekkel, de felzárkózhat a vezető kínai nyílt modellekhez. Az új összeg mintegy kilencszerese a korábbi, öt kiválasztott vállalatnak juttatott 530 milliárd wonos (kb. 390 millió dolláros) támogatásnak, miközben Google, Amazon, Microsoft és Meta együttesen 725 milliárd dollárt tervez befektetni 2026-ban, főként AI-adatközpontokba.

Google szűkíti az ingyenes Gemini-hozzáférést október 9-től

A The Verge beszámolója szerint október 9-től a Google ingyenes Gemini-felhasználói kizárólag a Flash Lite modellt érhetik el, miközben jelenleg még a Flash és a Pro verzió közül is választhatnak. A Google állítása szerint a sztenderd Flash modellhez ezután havi 4,99 dolláros Google AI Plus előfizetés kell, ám ez a csomag is leértékelődik, mivel hamarosan kikerül belőle a Gemini Pro elérése – az érintett előfizetőket a cég e-mailben értesíti a változás időpontjáról. A vállalat közlése alapján a Gemini Pro és a „Deep Think” nevű fejlett érvelési opció ezután kizárólag a havi 19,99 dolláros AI Pro vagy a 99,99 dolláros AI Ultra előfizetéssel lesz elérhető. A Google szerint a felhasználók továbbra is választhatnak alacsony, közepes és magas „effort” szintet az egyes modelleknél, de a magasabb szintek gyorsabban felélik a használati keretet.

Deepseek 12-15 milliárd dolláros finanszírozást gyűjt a CATL és a Tencent támogatásával

A Bloomberg értesülése szerint a kínai Deepseek legalább 12 milliárd dollárt gyűjt egy új finanszírozási körben, és a végösszeg elérheti a 15 milliárd dollárt is. A cég eredetileg mintegy 7,5 milliárd dollárt tervezett bevonni, körülbelül 75 milliárd dolláros értékelés mellett. A legnagyobb részt az akkumulátorgyártó CATL és a Tencent adja; a befektetői érdeklődést a V4-Flash modell hajtja, amely a Bloomberg szerint ár-teljesítmény tekintetben felveszi a versenyt az Anthropic és az OpenAI modelljeivel. A kör lezárása után a Deepseek átalakulna egy 2027 eleji tőzsdei bevezetésre, és legalább 160 ezer Huawei AI-chipre épülő adatközpontot épít, miközben saját inferencia-chipen is dolgozik, hogy csökkentse függőségét az Nvidiától és a Huaweitől. A kört korábban felfüggesztették, miután alapítója, Liang Wenfeng megjegyzései a cég Nvidia-chipektől való függéséről vírusszerűen terjedtek; júniusban a Deepseek már lezárt egy 7,4 milliárd dolláros, 50 milliárd dollár feletti értékelésű kört.