Hatékony nyelvi modell kialakításán dolgoznak a Szegedi Tudományegyetem kutatói

szerkeszto 2024.09.16. 3 minutes read

Kövess és lájkolj minket:

„A nagy mesterséges intelligencia (AI) cégek által alkalmazott megoldásoknál lényegesen kisebb szövegmennyiséget és számítási kapacitást igénylő hatékony nyelvi modell kialakításán dolgoznak a Szegedi Tudományegyetem (SZTE) kutatói – közölte honlapján a felsőoktatási intézmény.

A nyelvi modellek a szövegek értelmezésére és feldolgozására, vagyis egy emberi képesség szimulálására törekszenek. A nemzetközi AI-cégek révén megismert nagy nyelvi modellek gépi tanításra alkalmazott célfüggvényei mégis figyelmen kívül hagyják az emberi megértés sajátosságait. Ez idézi elő azt a helyzetet, hogy a nagy nyelvi modellek drágán, rendkívüli adatpazarlással és alacsony hatékonysággal tudják elérni az emberi megértés szimulációját – magyarázta Berend Gábor, az SZTE Számítógépes Algoritmusok és Mesterséges Intelligencia Tanszékén docense, aki kutatásaihoz Bolyai-ösztöndíjat nyert.

A klasszikus maszkolt nyelvi modellezés során 100 milliárdnyi mondattal tanítják a rendszert, majd ezek bizonyos mennyiségű szavát kitakarják. A nyelvi modell célja, hogy képes legyen megállapítani, a kitakar helyen pontosan milyen szó állhatott. Így a tanulás lépései nem tükrözik az emberi gondolkodásmódot.

Az SZTE kutatóinak eljárása során egy segédmodellel előbb a szavakhoz kötődő rejtett fogalmi kategóriákat szeretnék automatikusan felállítani. Egy szöveg számítógépes reprezentációja során egy-egy szó által fedett dolgot ezer szempontból értékelhetnek, ezek közül azonban csupán néhány lesz valóban jellemző, melyek meghatározzák a fogalmi kategóriákat. Ezt az alternatív előtanítási eljárást maszkolt látens szemantikai modellezésnek nevezték el, és angol, valamint magyar nyelvre is következetesen jobb eredményeket adott, mint a klasszikus maszkolt nyelvi modellezés.

Berend Gábor az eljárás első eredményeit 2020-ban publikálta, míg a nagy AI-cégek csak a közelmúltban kezdték el nyelvi modelljeik fogalmi hierarchiáját hasonló módszerrel feltérképezni. Míg azonban a vállalkozások ezt csak leíró jelleggel végzik, a szegedi kutatók a módszert az új modellek létrehozásánál is alkalmazzák.”

Címlap fotó: Hans Lucas via AFP/Eric Beracassat
Az eredeti, teljes írást itt olvashatja el.

Kövess és lájkolj minket:

szerkeszto

Administrator

Visit Website View All Posts

Tags: AI nyelvi modell SZTE

Kapcsolódó cikkek

Zelenszkij rendeletben engedélyezte a moszkvai parádét

Ezért kerül ilyen sokba a jogosítvány, és még plusz költséggel is számolni kell

Moha-lepte romok az erdőben: a felrobbantott vasasi duzzasztógát tragikus története

Amit még érdemes elolvasni

Zelenszkij rendeletben engedélyezte a moszkvai parádét

Ezért kerül ilyen sokba a jogosítvány, és még plusz költséggel is számolni kell

Moha-lepte romok az erdőben: a felrobbantott vasasi duzzasztógát tragikus története

A rendőrség közölte, mi okozta Dudás Miklós halálát

About the Author

Kapcsolódó cikkek

Amit még érdemes elolvasni