CoolFace
Datasetpublic

PraxySante/FR_VocalCommands_medical_dictation

FR_VocalCommands_medical_dictation Commandes vocales de dictee medicale en francais (PraxyDictee) : edition, selection, formatage, majuscules et dictee ponctuee, commentees avec des mots medicaux (molecules et pathologies des jeux precedents). element valeur textes 22500 fichiers audio 22500 moteurs coqui XTTS v2 (300 voix clonees), edge-tts, gTTS augmentations low_rms (volume -22 dB), low_rms_speedup (atempo 1.2) format WAV mono 16 kHz QC inference NeMo… See the full description on the dataset page: https://huggingface.co/datasets/PraxySante/FR_VocalCommands_medical_dictation.

sourceHugging Faceotherupdated 16d agoView on Hugging Face
0likes282downloads
Dataset Card

FRVocalCommandsmedical_dictation

Commandes vocales de dictee medicale en francais (PraxyDictee) : edition, selection, formatage, majuscules et dictee ponctuee, commentees avec des mots medicaux (molecules et pathologies des jeux precedents).

elementvaleur
textes22500
fichiers audio22500
moteurscoqui XTTS v2 (300 voix clonees), edge-tts, gTTS
augmentationslowrms (volume -22 dB), lowrms_speedup (atempo 1.2)
formatWAV mono 16 kHz
QCinference NeMo (CER) - les 10% les plus mauvais ont ete retires

Structure

audio/<engine>/<shard>/<index>.wav
audio_lowrms/<shard>/...
audio_lowrms_speedup/<shard>/...
metadata.jsonl   (audio_filepath, text, duration, engine, voice, command_type)
parquet/         (audio binaire + text + engine)

Usage NeMo

python
manifest = "metadata.jsonl"   # audio_filepath relatif au repo
PraxySante/FR_VocalCommands_medical_dictation · CoolFace