datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
sindhi-corpus-langid-cleanscandi-langid
Dataset Card for "scandi-langid"
More Information needed
lang_id_englangid-ind_Latnlangid-dan_Latnlangid-ces_Latnlangid-tur_Latncmac_adv_langidlangid-fra_Latnlangid-zho_Hanslangid-nld_Latnbwki2025-lowres-langid-dataset
Tobero/bwki2025-lowres-langid-dataset
BWKI 2025 Spracherkennung's Datenset
Contents
train: 75 shard(s)
Load with datasets
from datasets import load_dataset
ds = load_dataset("Tobero/bwki2025-lowres-langid-dataset")
print(ds)
langid-hin_Deva
