Nyelvmodellek kurzusunk anyagai

Múlt héten Kolozsvárott jártunk és egy kurzust tartottunk a nyelvmodellekről az MCC diákjainak. A posztban elérhetők diáink, a kapcsolódó modellek, repo és Colabon futtatható Jupyter notebookok.

A kurzus során áttekintettük a nyelvmodellek történeti alakulását, Markov 1913-as tanulmányától egészen a modern transformer architektúrákig.

Majd két esettanulmányon keresztül mutattuk be hogyan lehet használni a nyelvmodelleket a tartalomelemzésben. Az első a Nyelv és Tudományon megjelent Apának munkája van, anyának teste című cikkünkön alapult.

A második esettanulmány a magyar népmeséket elemző új projektünket mutatta be.

A kapcsolódó GitHub repo elérhető itt. A notebooks mappában elérhető Jupyter notebookok „Open in Colab” ikonra kattintva Colab-ben nyílnak meg. A használt nyelvmodelleket tartalmazó Google Drive mappa ezen a linken érhető el. A GitHub repo README-ben részletes leírás található arról, hogyan lehet futtatni a notebookokat Colaben.

Do you like our visualizations? Buy them for yourself!

Visit our shop on Society6 to get a printout of our vizs.