diff --git a/pages/students/2022/andrii_pervashov/README.md b/pages/students/2022/andrii_pervashov/README.md index 4285a843..607099ff 100644 --- a/pages/students/2022/andrii_pervashov/README.md +++ b/pages/students/2022/andrii_pervashov/README.md @@ -35,7 +35,6 @@ Teoretické úlohy: - Oboznámte sa s postupmi pre dotrénovanie jazykového modelu - LORA, PEFT. - Oboznámte sa s metódami Information Extraction. Vyhľadajte si články na túto tému a napíšte, aké metódy sa používajú. Vstupom je text v prir. jazyku, výstupom je niečo ako JSON. - Zásobník úloh: - Vyskúšajte ako funguje rozpoznávanie reči cez OPeWEBUI. Navrhnute zlepšenia. - Ako vieme zistiť, ktoré informácie nám chýbajú? @@ -47,6 +46,16 @@ Stav: - Urobený deployment na http://147.232.204.160:3000/ - Prečítané základy Lora a information extraction podľa inštrukcií. +Úlohy: + +- Presne špecifikovať scenár, ktorý riešime. Nemusí byť z medicínskej oblasti. +- Pohľadajte vhodnú existujúcu dátovú pre tento scenár. Nemusí byť po slovensky. Príkladom môžu byť úlohy súvisiace s prepisom stretnutí - meeting speech. +- Použite existujúci prepisovať a jazykový model pre riešenie tejto úlohy. +- Použite trénovaciu časť tejto množiny pre zlepšenie aktuálnych modelov. Môžete využiť PEFT alebo RAG. +- Do písomnej časti napúíšte definíciu úälohy, prehľad existujúcich dátových množín, prehľad metód riešenia definovanej úlohy a opis Vášho riešenia. +- Otestujte Vaše riešenie na testovacej časti dátovej množiny. + + Stretnutie 10.6.2026