datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
taras_shau_chenka_vershy_paemy_all
Вершы і паэмы
Аўтар / Author: Тарас ШаўчэнкаМова / Language: Беларуская (Belarusian)
Аўдыё нарэзана з арыгінальнага запісу ў зыходнай частаце дыскрэтызацыі (native), мона, фрагменты да 30 секунд.
Частка калекцыі Belarusian Audiobooks (native).
Радкоў у датасеце
253
Працягласць
51 хв
Частата дыскрэтызацыі
44100 Hz
Каналы
мона
Даўжыня фрагмента
да 30 с
Структура
Кожны радок змяшчае:
audio — аўдыёфрагмент (native SR, мона, ≤30 с)
text —… See the full description on the dataset page: https://huggingface.co/datasets/fosters/taras_shau_chenka_vershy_paemy_all.taras_shau_chenka_vershy_paemy_output_original
Вершы і паэмы — арыгінальнае аўдыё
Аўтар / Author: Тарас ШаўчэнкаМова / Language: Беларуская (Belarusian)
Арыгінальнае аўдыё без апрацоўкі, захаванае ў зыходнай якасці.
Частка калекцыі Ministerskija —
корпус беларускіх аўдыёкніг.
Апрацаваная версія (сегменты ~15 с, выраўнаваная транскрыпцыя):
taras_shau_chenka_vershy_paemy_output
Доўгасць аўдыё
0h53m
Радкоў у датасеце
208
Структура
Кожны радок змяшчае:
audio — арыгінальны аўдыёзапіс
text —… See the full description on the dataset page: https://huggingface.co/datasets/fosters/taras_shau_chenka_vershy_paemy_output_original.
