From d58d4dfb69f80704e750d0970cbffaea6c8917f2 Mon Sep 17 00:00:00 2001 From: dano Date: Tue, 25 Jun 2024 08:13:51 +0000 Subject: [PATCH] Update 'pages/students/2022/valerii_kutsenko/README.md' --- pages/students/2022/valerii_kutsenko/README.md | 10 ++++++++-- 1 file changed, 8 insertions(+), 2 deletions(-) diff --git a/pages/students/2022/valerii_kutsenko/README.md b/pages/students/2022/valerii_kutsenko/README.md index 8959bc2a1..7670df6a3 100644 --- a/pages/students/2022/valerii_kutsenko/README.md +++ b/pages/students/2022/valerii_kutsenko/README.md @@ -12,7 +12,7 @@ rok začiatku štúdia: 2022 # Bakalárska práca 2025 - +Generovanie otázok zo zadaného textu. Cieľ je vylepšiť slovenský model pre generovanie vektrovej reprezentácie. vylepšiť proces RAG: Generovanie jazyka s pomocou vyhľadávania -Retrieval augmented generation @@ -27,14 +27,20 @@ Ako na to: - Natrénujte generatívny model pre generovanie otázok. Použite existujúci skript a množinu SKQUAD. - Určite, ktorá otázka je dobre vygenerovaná a ktorá nie. Tu môžete použiť: systém pre vyhľadávanie alebo neurónovú sieť pre otázky a odpovede. Ku otázke viete nájsť odpovede pomocou neurónovej siete. Výstupom by mala byť čo najkvalitnejšia množina otázok a dpovedí ku odsekom. -- Výstupom by mala byť umelo generovaná datqabáza otázok a odpovedí. +- Výstupom by mala byť umelo generovaná databáza otázok a odpovedí. Úlohy: +- Zistite, aké sú možné prístupy ku generovaniu otázok pomocou generatívneho modelu a aké sú možné prístupy k overeniu vygenerovanej otázky. - Pozrite si repozitár https://github.com/patil-suraj/question_generation - Pozrite si repozitár https://github.com/gauthierdmn/question_generation - Pozrite si článok https://telrp.springeropen.com/articles/10.1186/s41039-021-00151-1 - Oboznámte sa s DP Ondrej Megela. +- Oboznámte sa s knižnicou HF transformers - vyskúšajte si nejaký tutoriál. +- Zistite, ako funguje model T5. +- Pozrite si skript `generate/run_qg.py` v [repo](https://git.kemt.fei.tuke.sk/dano/slovakretrieval) a vyskúšajte ho. +- Čítajte súvisiace odborné články a robte si poznámky. +- Urobte si repozitár na git.kemt a dávajte tam Vaše skripty.