CoolFace
Datasetpublic

dasdfdaa/Low-Resource_Audio

数据展示选取四种语言:西班牙语(es)与德语(de)作为基座语言,卡拜尔语(kab)与卢干达语(lg)作为新到来的语种,均取自 Common Voice Scripted Speech 26.0 的训练划分,每种语言各取其中一部分语句,音频统一重采样为 16 kHz 单声道。 这一组合有两点值得说明:es/de 与 kab/lg 分属不同语系,因此可以考察跨语系的迁移与干扰;而两侧在语料规模上存在明显落差,正好对应监督信息受限下的适应场景。

sourceHugging Faceapache-2.0updated 3d agoView on Hugging Face
0likes27downloads
3 commits on main
e1fa2263d ago

Update README.md

dasdfdaa
12c64103d ago

Upload 低资源语音音频数据集.zip

dasdfdaa
2cdbe383d ago

initial commit

dasdfdaa