Update pages/students/2022/andrii_pervashov/README.md

This commit is contained in:
dano 2024-08-14 13:11:29 +00:00
parent 42e71e2dd9
commit 6b72a975e8

View File

@ -34,3 +34,20 @@ Stretnutie 26.4. 2024
- Zistite ako funguje tento model https://huggingface.co/docs/transformers/en/model_doc/byt5 - Zistite ako funguje tento model https://huggingface.co/docs/transformers/en/model_doc/byt5
- Napíšte si poznámky o tom ako funguje model Transformers a ako funguje model T5. - Napíšte si poznámky o tom ako funguje model Transformers a ako funguje model T5.
Stav:
- Nainštalovaná Anaconda, rozbehaný anlgický trénovací skript s databázou WikiEdits a modelom T5small. Notebook je príliš pomalý na trénovanie.
- Oboznámenie sa s materiálmi - d2dl aj Python.
Úlohy:
- Pokračujte v štúdiu modelov T5 aj GPT aj ChatGPT. Robte si písomné poznámky. Poznačte si odkazy na odborné články, napr. Arxiv.
- Použite server google scholar a zistite ako sa robí ooprava textu pomocu modelu T5. Poznačte si články ktoré sa týkajú tejto témy a napíšte o čom tie články sú.
- Prečítajte si môj článok Survey of Automatic Spelling Correction a urobte si poznámky,
- dotrénujte anglický model t5 small na opravu a vyhodnotte ho. Na vyhodnotneie sa používa metrika WER, CER, SER, BLEU. Zistite čo to je.
Zásobník úloh:
- Natrénujte model pre opravu textu v slovenskom jazyku.
- Pripravte webové demo.