El sem hinnéd, ki ígér a ChatGPT-t is lepipáló új technológiát

2023.02.26.
Olvasási idő: 2 perc

Új nyelvi modellt mutattak be LLaMA néven, amely egyetlen jobbféle számítógépes GPU-n is futhat, és állítólag tízszer kisebb mérete ellenére is hasonlót nyújt, mint a ChatGPT. Így végső soron felülmúlja annak technológiáját.

A Meta, a Facebook anyavállalata pénteken bejelentette a LLaMA-13B nevű új, AI– (mesterséges intelligencia) alapú “nagy nyelvi modellt” (LLM), amely állítása szerint tízszer kisebb mérete ellenére is képes felülmúlni az OpenAI GPT-3 modelljét. A kisebb méretű AI-modellek lehetővé tehetik, hogy a ChatGPT-stílusú nyelvi asszisztensek helyben fussanak az olyan eszközökön, mint a PC-k és az okostelefonok.

Forrong az egész mesterségesintelligencia-iparág

Ez egy új nyelvimodell-család része, amelyet “Large Language Model Meta AI”, röviden LLAMA névre kereszteltek. A LLaMA nyelvi modellek gyűjteménye hétmilliárd és 65 milliárd paraméter közötti teljesítményűek. Összehasonlításképpen, az OpenAI GPT-3 modellje – a ChatGPT alapmodellje – 175 milliárd paraméterrel rendelkezik.

A Meta a LLaMA modelljeit nyilvánosan elérhető adathalmazok (mint a Common Crawl, a Wikipedia vagy a C4) segítségével tanította be, így elvileg nyílt forráskódúvá is teheti a modellt. Ez drámai új fejlemény lenne egy olyan iparágban, ahol eddig a nagy technológiai szereplők a mesterséges intelligenciáért folyatott versenyfutásban a legerősebb csúcsmodelleket megtartották maguknak – írja az Ars Technica.

  • A Chinchillával, a PaLM-mel vagy a GPT-3-mal ellentétben mi csak nyilvánosan elérhető adatkészleteket használunk, így munkánk reprodukálható. Míg a legtöbb létező modell olyan adatokra támaszkodik, amelyek vagy nem nyilvánosak, vagy dokumentálatlanok –  tweetelte a projekt résztvevője, Guillaume Lample.

A Meta “alapozó modelleknek” (foundational models) nevezi, mert szándéka szerint a technológia jövőbeli, továbbfejlesztett AI-modellek alapját képezi majd. Hasonlóan ahhoz, ahogyan az OpenAI a GPT-3 alapjaira építette a ChatGPT-t. Míg a csúcs LLaMA modell LLaMA-65B 65 milliárd paraméterrel rendelkezik, a konkurens laborok DeepMind, Google és OpenAI hasonló ajánlataival vetekszik.

Zsebünkben lesz egy intelligens Llama?

A legérdekesebb a LLaMA-13B, amely állítólag képes felülmúlni a GPT-3 teljesítményét, miközben egyetlen GPU-n (grafikai processzoron) fut. Így megnyitja az utat, hogy a ChatGPT-hez hasonló teljesítmény a fogyasztók hardverein fusson. A nyelvi modell paramétereinek száma kulcsfontosságú tényező a teljesítmény szempontjából, a nagyobb modellek általában összetettebb feladatokat képesek kezelni és koherensebb kimenetet tudnak produkálni. (Apró érdekesség, hogy a llama szó spanyolul lámát jelent.)

Egy-két éven belül a ChatGPT képességeinek jelentős részével rendelkező nyelvi modelleket fogunk futtatni a saját (felső kategóriás) mobiltelefonjainkon és laptopjainkon – írta Simon Willison független AI-kutató a Mastodonon.

Jelenleg a LLaMA egy lecsupaszított változata érhető el a GitHubon. A teljes kód megszerzéséhez a Meta egy űrlapot biztosít, amelyen az érdeklődő kutatók hozzáférést kérhetnek. Egyelőre nem jelentették be a modell szélesebb körű hozzáférhetővé tételének terveit.

Kapcsolódó cikkeink:

Címlapkép forrása: Pixabay.com

Latest from Blog

Az El Niño időzített bombává változtatja az óceánt

A mexikói Michoacán állam tengerpartján, Lázaro Cárdenas kikötővárosában a hullámok már napok óta gyanúsan magasra csaptak. Az óceán morajlása nem a megszokott trópusi ritmust követte, hanem egy készülő katasztrófa baljós nyitányát sejtették.

Emberi hűtőszekrényt találtak ki a japánok a hőség ellen

Idén nyáron a világszerte tapasztalható, rekordszintű hőmérsékletek ismét élesen emlékeztettek a klímaváltozás egyre súlyosbodó hatásaira. Ha nincs légkondicionálód vagy medencéd, amelyben lehűthetnéd magad, nagyon kevés lehetőséged marad arra, hogy elmenekülj a hőség
MrBeast

Évi 75 millió? Ezek a legjobban fizető AI-állások

Nem kell teljes karrierváltás ahhoz, hogy valaki évi tízmilliókkal többet keressen. Elég a meglévő tech-tudásra ráépíteni az AI-készségeket, hogy valaki akár 85%-kal többet keressen. 85%-kal is többet fizethet az AI-tudás, itt a

Itt a textil, ami a világűrbe küldi a nyári hőséget

Az Adelaide-i Egyetem kutatói egy Nobel-díjas technológiai áttörés segítségével forgatják fel a nyári öltözködés évszázados szabályait. A nyári kánikula beálltával az évszázados megszokás és a józan ész mindig azt diktálja, hogy a

A világ leggyilkosabb mérgét keverte ki egy egyetemista

Szirénázó rendőrautók, tűzoltók és speciális vegyivédelmi alakulatok sora lepték el a Massachusetts Institute of Technology (MIT) campusát, miután a világ egyik legtekintélyesebb tudományos egyetemén pánikszerű riasztást váltott ki az egyik hallgató rendkívül

Kipukkadt a hidrogénlufi: A zöld energia kiábrándító valósága

Elon Musk egyszer „megdöbbentően nagy ostobaságnak” nevezte a hidrogén üzemanyagként való használatát az autóiparban, ám a világ egyik legsikeresebb elektromosautó-gyártójának elutasítása sem tudta eltántorítani a politikai döntéshozókat attól, hogy a zöld energia

Így szorított ki tízezer nyelvet az angol

Amikor a Föld nyelvi sokszínűségére gondolunk, többnyire a ma aktívan használt, nagyjából hétezer beszélt nyelvből indulunk ki. Ez a lenyűgöző adat azonban csupán egyetlen pillanatfelvétel az emberiség több tízezer éves történetében. Nyelvészek

Ezért buknak el a külföldi alapkezelők Kínában

A Fidelity International (FIL) a legújabb globális alapkezelő, amely a hírek szerint mérlegeli a kínai lakossági alapkezelési üzletágból való kivonulást. A cég három évvel ezelőtt teljes egészében saját tulajdonú leányvállalatot hozott létre

Mielőtt továbblépnél