CoolFace
Datasetpublic

kalilouisangare/bambara-speech-kis-clean-split

Bambara Speech Dataset — Clean & Split Dataset de reconnaissance vocale en bambara, nettoyé et splitté pour le fine-tuning de modèles ASR (ex: Whisper). La source principale des données brutes est RobotsMali/bam-asr-early, auquel un remerciement chaleureux lui est attribué mais aussi à d'autres personnes référencées ci-dessous dans la section citation. Statistiques Total : 35 342 échantillons Train : 24 738 Validation : 3 535 Test : 7 069 Durée moyenne : 3.23s… See the full description on the dataset page: https://huggingface.co/datasets/kalilouisangare/bambara-speech-kis-clean-split.

sourceHugging Facecc-by-4.0updated 7mo agoView on Hugging Face
2likes31downloads

kalilouisangare/bambara-speech-kis-clean-split · main · files are served by the source, never re-hosted here