Harisri/indic-fusion-hi-mr
Indic-FUSION Hindi-Marathi Pseudo-Parallel Speech A research pseudo-parallel speech corpus for Indic-FUSION. Construction Source speech is sampled from ai4bharat/indicvoices_r. For each source utterance: The source dataset transcript is used directly. NLLB generates a direct Indic-to-Indic target transcript. ai4bharat/IndicF5 synthesizes target-language speech using the source utterance as the reference prompt. The target audio is therefore synthetic, not… See the full description on the dataset page: https://huggingface.co/datasets/Harisri/indic-fusion-hi-mr.
Update README.md
Indic-FUSION pilot pseudo-parallel corpus (part 10)
Indic-FUSION pilot pseudo-parallel corpus (part 9)
Indic-FUSION pilot pseudo-parallel corpus (part 8)
Indic-FUSION pilot pseudo-parallel corpus (part 7)
Indic-FUSION pilot pseudo-parallel corpus (part 6)
Indic-FUSION pilot pseudo-parallel corpus (part 5)
Indic-FUSION pilot pseudo-parallel corpus (part 4)
Indic-FUSION pilot pseudo-parallel corpus (part 3)
Indic-FUSION pilot pseudo-parallel corpus (part 2)
Indic-FUSION pilot pseudo-parallel corpus
initial commit
