CoolFace
Datasetpublic

DrIAmed/darija-youtube-dataset

Darija YouTube Dataset A dataset of Moroccan Arabic (Darija) speech scraped from YouTube, with transcriptions in Arabic script, Latin script (Arabizi), and English translations. Dataset Description This dataset contains sentence-level audio segments of Darija speech, paired with: Arabic transcription (modern Moroccan Arabic script) Latin transliteration (Arabizi format: 3=ع, 7=ح, 9=ق, etc.) English translation Columns Column Type Description… See the full description on the dataset page: https://huggingface.co/datasets/DrIAmed/darija-youtube-dataset.

sourceHugging Faceupdated 7mo agoView on Hugging Face
0likes23downloads
12 commits on main
a3057b67mo ago

Upload dataset

DrIAmed
4d217fa7mo ago

Upload dataset

DrIAmed
5f5bd8b7mo ago

Upload dataset

DrIAmed
47783597mo ago

Upload dataset

DrIAmed
4f4de587mo ago

Upload dataset

DrIAmed
08113097mo ago

Upload dataset

DrIAmed
56ee2f17mo ago

Upload dataset

DrIAmed
2c4262d7mo ago

Upload dataset

DrIAmed
e9434527mo ago

Upload dataset

DrIAmed
7daf5b17mo ago

Upload README.md with huggingface_hub

DrIAmed
871b06c7mo ago

Upload dataset

DrIAmed
a377bb17mo ago

initial commit

DrIAmed