datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
Jevanhielle_Zyhamont10_30Jevanhielle_Zyhamont_outCheckedknihi-be-jeva_vieznaviec_pa_sto_idzies_vouca_all
AudioSet Pipeline Output
Мова / Language: Беларуская (Belarusian)
Аўдыё нарэзана з арыгінальнага запісу ў зыходнай частаце дыскрэтызацыі (native), мона, фрагменты да 30 секунд.
Частка калекцыі Belarusian Audiobooks (native).
Радкоў у датасеце
1,023
Працягласць
3 гадз 26 хв
Частата дыскрэтызацыі
44100 Hz
Каналы
мона
Даўжыня фрагмента
да 30 с
Структура
Кожны радок змяшчае:
audio — аўдыёфрагмент (native SR, мона, ≤30 с)
text — транскрыпцыя… See the full description on the dataset page: https://huggingface.co/datasets/fosters/knihi-be-jeva_vieznaviec_pa_sto_idzies_vouca_all.knihi-be-jeva_vieznaviec_pa_sto_idzies_vouca_output_original
AudioSet Pipeline Output — арыгінальнае аўдыё
Мова / Language: Беларуская (Belarusian)
Арыгінальнае аўдыё без апрацоўкі, захаванае ў зыходнай якасці.
Частка калекцыі Ministerskija —
корпус беларускіх аўдыёкніг.
Апрацаваная версія (сегменты ~15 с, выраўнаваная транскрыпцыя):
knihi-be-jeva_vieznaviec_pa_sto_idzies_vouca_output
Структура
Кожны радок змяшчае:
audio — арыгінальны аўдыёзапіс
text — транскрыпцыя
chunk_uid — унікальны ідэнтыфікатар
Ліцэнзія… See the full description on the dataset page: https://huggingface.co/datasets/fosters/knihi-be-jeva_vieznaviec_pa_sto_idzies_vouca_output_original.Jevanhielle_Zyhamont_out
AudioSet Pipeline Output
Shard-based dataset export published by AudioSetPipeline.
Jevanhielle_Zyhamont0_10_Checkedknihi-be-jeva_vieznaviec_pa_sto_idzies_vouca
