CoolFace
Datasetpublic

rishchen/ukrainian-tts-audiobook-pani-nina-parquet

Ukrainian TTS audiobook dataset Pani Nina (Parquet) Segmented Ukrainian audiobook speech with aligned text, prepared for training and evaluating Text-to-Speech (TTS) models. The dataset is published as Hugging Face-compatible Parquet shards so the Hub Dataset Preview can render an audio column. The dataset was prepared using whisper and ffmpeg: Whisper was used for transcription and approximate segment timing. FFmpeg was used to slice audio into short utterances (roughly 2-10… See the full description on the dataset page: https://huggingface.co/datasets/rishchen/ukrainian-tts-audiobook-pani-nina-parquet.

sourceHugging Facecc-by-nc-sa-4.0updated 5mo agoView on Hugging Face
0likes17downloads
filetrain_base-00000.parquet1004.7 MBdownload
filetrain_base-00001.parquet974.4 MBdownload
filetrain_base-00002.parquet960.2 MBdownload
filetrain_base-00003.parquet992.7 MBdownload
filetrain_base-00004.parquet982.2 MBdownload
filetrain_base-00005.parquet962.1 MBdownload
filetrain_base-00006.parquet984.7 MBdownload
filetrain_base-00007.parquet969.5 MBdownload
filetrain_base-00008.parquet968.5 MBdownload
filetrain_base-00009.parquet960.7 MBdownload
filetrain_base-00010.parquet981.1 MBdownload
filetrain_base-00011.parquet1010.1 MBdownload
filetrain_base-00012.parquet1017.7 MBdownload
filetrain_base-00013.parquet817.2 MBdownload

rishchen/ukrainian-tts-audiobook-pani-nina-parquet · main · files are served by the source, never re-hosted here