CoolFace
Datasetpublic

Zarakun/youtube_ua_noisy_subtitles_test

The list of all subsets in the dataset Each subset is generated splitting videos from given particular ukrainiam YouTube channel All subsets are in test split "opodcast" subset is from channel "О! ПОДКАСТ" "rozdympodcast" subset is from channel "Роздум | Подкаст" "test" subset is just a small subset of samples Loading a particular subset >>> data_files = {"train": "data/<your_subset>.parquet"} >>> data = load_dataset("Zarakun/youtube_ua_subtitles_test"… See the full description on the dataset page: https://huggingface.co/datasets/Zarakun/youtube_ua_noisy_subtitles_test.

sourceHugging Faceupdated 3y agoView on Hugging Face
0likes11downloads
13 commits on main
96018563y ago

Upload README.md with huggingface_hub

Zarakun
0b396bd3y ago

Upload ./data/opodcast.parquet with huggingface_hub

Zarakun
d76f4233y ago

Upload README.md with huggingface_hub

Zarakun
65d5a6c3y ago

Upload README.md with huggingface_hub

Zarakun
2ca378a3y ago

Upload README.md with huggingface_hub

Zarakun
bab8a933y ago

Upload README.md with huggingface_hub

Zarakun
238b86d3y ago

Upload README.md with huggingface_hub

Zarakun
cc127773y ago

Upload README.md with huggingface_hub

Zarakun
195b2d83y ago

Upload README.md with huggingface_hub

Zarakun
05b79ef3y ago

Upload ./data/rozdympodcast.parquet with huggingface_hub

Zarakun
33a34463y ago

Create README.md

Zarakun
e6768723y ago

Upload ./data/test.parquet with huggingface_hub

Zarakun
09eef2e3y ago

initial commit

Zarakun