DaniilMako/even-russian-corpus
Even-Russian Corpus | Эвенско-русский корпус Эвенско-русский двуязычный текстовый корпус — параллельный корпус из ~50 тысяч пар предложений и словосочетаний на эвенском и русском языках. Датасет предназначен для исследований в области машинного перевода, обработки естественного языка и сохранения исчезающего эвенского языка (Тунгусо-маньчжурская семья -> Северная (сибирская) ветвь -> Эвенская группа -> Эвенский язык). О датасете Эвенский язык (Эвэды төрэн) —… See the full description on the dataset page: https://huggingface.co/datasets/DaniilMako/even-russian-corpus.
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Initial release: 50K Even-Russian pairs
initial commit
