Update pages/students/2024/kristian_sokolsky/README.md

This commit is contained in:
dano 2026-10-05 06:33:11 +00:00
parent ed61f97f1f
commit b0d6ff405e

View File

@ -14,6 +14,27 @@ rok začiatku štúdia: 2024
Zarovnávanie veľkých jazykových modelov Zarovnávanie veľkých jazykových modelov
Možné ciele semestrálneho projektu:
- Zlepšenie bezpečnosti jazykových modelov.
- Prípravu nových dát alebo zlepšenie existujúcich dát pre zarovnanie jazykových modelov. Napr. príprava korpusu Modrý koník alebo Modrá strecha.
- Výber najlepších metód a hyperparametrov pre zarovanie LLM.
Update 5.10
Stav:
- Preštudované problematika
Úlohy:
- Získajte dáta zo serra Modrý koník. Použite wget na získanie HTML súborov.
- Napíšte skript na tvorbu dátovej množiny vhodnej pre zarovnnie jazykového modelu pomocou frameworku trl.
- Pokračujte v štúdu Python a reinformcement learning.
- reporty vo formáte markdown, konfigurácie a kódy dávajte na kemt git.
Stretnutie 23.9.2026 Stretnutie 23.9.2026
Úlohy: Úlohy:
@ -26,11 +47,6 @@ Stretnutie 23.9.2026
- Zistite, čo je to kontrolované učenie a čo je to učenie odmenou a trestom (reinforcement learning). Napíšte o tom krátku správu (2 alebo 3 strany) kde uvediete aj relevantné vedecké články. - Zistite, čo je to kontrolované učenie a čo je to učenie odmenou a trestom (reinforcement learning). Napíšte o tom krátku správu (2 alebo 3 strany) kde uvediete aj relevantné vedecké články.
- Oboznámte sa s frameworkom [TRL](https://huggingface.co/docs/trl/en/index) - Oboznámte sa s frameworkom [TRL](https://huggingface.co/docs/trl/en/index)
Možné ciele semestrálneho projektu:
- Zlepšenie bezpečnosti jazykových modelov.
- Prípravu nových dát alebo zlepšenie existujúcich dát pre zarovnanie jazykových modelov. Napr. príprava korpusu Modrý koník alebo Modrá strecha.
- Výber najlepších metód a hyperparametrov pre zarovanie LLM.