diff --git a/pages/students/2016/jakub_maruniak/dp2021/annotation/README.md b/pages/students/2016/jakub_maruniak/dp2021/annotation/README.md index 63c2525d..68a5720c 100644 --- a/pages/students/2016/jakub_maruniak/dp2021/annotation/README.md +++ b/pages/students/2016/jakub_maruniak/dp2021/annotation/README.md @@ -1,13 +1,11 @@ -## Diplomový projekt 1 2020 +## Diplomový projekt 2 2020 - vytvorenie a spustenie docker kontajneru ``` ./build-docker.sh -docker run -it -p 8080:8080 -v ${PWD}:/work prodigy bash -# (v mojom prípade:) -winpty docker run --name prodigy -it -p 8080:8080 -v C://Users/jakub/Desktop/annotation/work prodigy bash +winpty docker run --name prodigy -it -p 8080:8080 -v C://Users/jakub/Desktop/annotation-master/annotation/work prodigy bash ``` @@ -17,5 +15,5 @@ winpty docker run --name prodigy -it -p 8080:8080 -v C://Users/jakub/Desktop/ann - `dataminer.csv` články stiahnuté z wiki - `cd ner` - `./01_text_to_sent.sh` spustenie skriptu *text_to_sent.py*, ktorý rozdelí články na jednotlivé vety -- `./02_ner_correct.sh` spustenie anotačného procesu pre NER s návrhmi od modelu -- `./03_ner_export.sh` exportovanie anotovaných dát vo formáte jsonl potrebnom pre spracovanie vo spacy +- `./02_ner_manual.sh` spustenie manuálneho anotačného procesu pre NER +- `./03_export.sh` exportovanie anotovaných dát vo formáte json potrebnom pre spracovanie vo spacy. Možnosť rozdelenia na trénovacie (70%) a testovacie dáta (30%) (--eval-split 0.3).