diff --git a/pages/students/2022/valerii_kutsenko/README.md b/pages/students/2022/valerii_kutsenko/README.md index 8959bc2a..7670df6a 100644 --- a/pages/students/2022/valerii_kutsenko/README.md +++ b/pages/students/2022/valerii_kutsenko/README.md @@ -12,7 +12,7 @@ rok začiatku štúdia: 2022 # Bakalárska práca 2025 - +Generovanie otázok zo zadaného textu. Cieľ je vylepšiť slovenský model pre generovanie vektrovej reprezentácie. vylepšiť proces RAG: Generovanie jazyka s pomocou vyhľadávania -Retrieval augmented generation @@ -27,14 +27,20 @@ Ako na to: - Natrénujte generatívny model pre generovanie otázok. Použite existujúci skript a množinu SKQUAD. - Určite, ktorá otázka je dobre vygenerovaná a ktorá nie. Tu môžete použiť: systém pre vyhľadávanie alebo neurónovú sieť pre otázky a odpovede. Ku otázke viete nájsť odpovede pomocou neurónovej siete. Výstupom by mala byť čo najkvalitnejšia množina otázok a dpovedí ku odsekom. -- Výstupom by mala byť umelo generovaná datqabáza otázok a odpovedí. +- Výstupom by mala byť umelo generovaná databáza otázok a odpovedí. Úlohy: +- Zistite, aké sú možné prístupy ku generovaniu otázok pomocou generatívneho modelu a aké sú možné prístupy k overeniu vygenerovanej otázky. - Pozrite si repozitár https://github.com/patil-suraj/question_generation - Pozrite si repozitár https://github.com/gauthierdmn/question_generation - Pozrite si článok https://telrp.springeropen.com/articles/10.1186/s41039-021-00151-1 - Oboznámte sa s DP Ondrej Megela. +- Oboznámte sa s knižnicou HF transformers - vyskúšajte si nejaký tutoriál. +- Zistite, ako funguje model T5. +- Pozrite si skript `generate/run_qg.py` v [repo](https://git.kemt.fei.tuke.sk/dano/slovakretrieval) a vyskúšajte ho. +- Čítajte súvisiace odborné články a robte si poznámky. +- Urobte si repozitár na git.kemt a dávajte tam Vaše skripty.