diff --git a/pages/students/2024/kristian_sokolsky/README.md b/pages/students/2024/kristian_sokolsky/README.md index 3459b5a0..580f7456 100644 --- a/pages/students/2024/kristian_sokolsky/README.md +++ b/pages/students/2024/kristian_sokolsky/README.md @@ -14,6 +14,27 @@ rok začiatku štúdia: 2024 Zarovnávanie veľkých jazykových modelov +Možné ciele semestrálneho projektu: + +- Zlepšenie bezpečnosti jazykových modelov. +- Prípravu nových dát alebo zlepšenie existujúcich dát pre zarovnanie jazykových modelov. Napr. príprava korpusu Modrý koník alebo Modrá strecha. +- Výber najlepších metód a hyperparametrov pre zarovanie LLM. + +Update 5.10 + +Stav: + +- Preštudované problematika + +Úlohy: + + + +- Získajte dáta zo serra Modrý koník. Použite wget na získanie HTML súborov. +- Napíšte skript na tvorbu dátovej množiny vhodnej pre zarovnnie jazykového modelu pomocou frameworku trl. +- Pokračujte v štúdu Python a reinformcement learning. +- reporty vo formáte markdown, konfigurácie a kódy dávajte na kemt git. + Stretnutie 23.9.2026 Úlohy: @@ -26,11 +47,6 @@ Stretnutie 23.9.2026 - Zistite, čo je to kontrolované učenie a čo je to učenie odmenou a trestom (reinforcement learning). Napíšte o tom krátku správu (2 alebo 3 strany) kde uvediete aj relevantné vedecké články. - Oboznámte sa s frameworkom [TRL](https://huggingface.co/docs/trl/en/index) -Možné ciele semestrálneho projektu: - -- Zlepšenie bezpečnosti jazykových modelov. -- Prípravu nových dát alebo zlepšenie existujúcich dát pre zarovnanie jazykových modelov. Napr. príprava korpusu Modrý koník alebo Modrá strecha. -- Výber najlepších metód a hyperparametrov pre zarovanie LLM.