This commit is contained in:
Daniel Hládek 2026-08-13 14:05:23 +02:00
parent 409ff66d72
commit c438574986

View File

@ -41,8 +41,8 @@ Project tasks update:
- Prepare a multilingual parallel corpus from OPUS data
- Prepare dataset for visual language model evaluation from foto
- Prepare dataset for visual language model evaluation from wikipedia
- Prepare corpus of text and image data from pravda.sk
- Prepare dataset for visual language model evaluation from wikipedia. You can use https://huggingface.co/datasets/wikimedia/wit_base .
- Prepare corpus of text and image data from pravda.sk .
Outupus: