AI-modell · Modellek

Llama

A Meta által fejlesztett nagy nyelvi modellcsalád, amelynek több változatát nyílt súlyokkal teszik elérhetővé kutatók és fejlesztők számára.

Más néven: LLaMA, Large Language Model Meta AI, Llama 2, Llama 3, Meta Llama

A Llama a Meta (korábban Facebook) mesterséges intelligencia kutatólaboratóriuma, a FAIR (később Meta AI) által létrehozott nagy nyelvi modellcsalád, amely a transzformer architektúrára épül. A modellt eredetileg elsősorban kutatási célokra fejlesztették, hogy hozzáférést biztosítsanak nagy teljesítményű nyelvi modellekhez olyan szereplőknek is, akik nem rendelkeznek a legnagyobb technológiai vállalatok erőforrásaival. Az azóta megjelent újabb generációk egyre nagyobb paraméterszámú és képességű változatokban érhetők el, gyakran szöveges és képi bemenetek kezelésére is alkalmas, multimodális kiterjesztésekkel.

A Llama modellek jelentősége abban rejlik, hogy súlyaikat viszonylag nyílt licencfeltételek mellett teszik elérhetővé, ami lehetővé teszi külső fejlesztők, cégek és kutatók számára a modellek finomhangolását, testreszabását és saját alkalmazásokba történő integrálását. Ez a megközelítés jelentősen hozzájárult a nyílt vagy félig nyílt nagy nyelvi modellek ökoszisztémájának bővüléséhez, és versenyt teremtett a kizárólag zárt, API-alapú modelleket kínáló szolgáltatókkal szemben.

A Llama-alapú modellek széles körben szolgálnak alapként chatbotok, kereső- és tartalomgeneráló alkalmazások, valamint kutatási projektek számára. A modellcsalád fejlődése és nyíltsági foka folyamatosan alakul, de általánosságban a mesterséges intelligencia demokratizálásának egyik szimbólumaként tartják számon, mivel csökkenti a belépési korlátot a fejlett nyelvi modellek használatához.

← Vissza az AI-szereplőkhöz