CoolFace
Datasetpublic

Bateesa/preacher-tts-dataset

Preacher TTS Dataset Dataset Description English speech dataset containing preacher/sermon audio recordings (grace_N.wav) segmented and transcribed. Audio recorded at 24 kHz stereo. Languages Language: English BCP-47: en Source tag preacher — value of the source column in every row. Dataset Structure Column Type Description audio Audio Raw WAV audio at original recording frequency text string… See the full description on the dataset page: https://huggingface.co/datasets/Bateesa/preacher-tts-dataset.

sourceHugging Facecc-by-4.0updated 7mo agoView on Hugging Face
0likes13downloads
Dataset Card

Preacher TTS Dataset

Dataset Description

English speech dataset containing preacher/sermon audio recordings (grace_N.wav) segmented and transcribed. Audio recorded at 24 kHz stereo.

Languages

  • —Language: English
  • —BCP-47: en

Source tag

preacher — value of the source column in every row.

Dataset Structure

ColumnTypeDescription
audioAudioRaw WAV audio at original recording frequency
textstringTranscription of the spoken content
frequencyintSample rate in Hz of the audio
sourcestringOrigin label (preacher)

Splits

SplitSamples
train375

Related Work

Prepared in the context of East African speech technology research.

License

CC BY 4.0

Citation

bibtex
@dataset{preacher_tts,
  author    = {Bateesa},
  title     = {Preacher TTS Dataset},
  year      = {2025},
  publisher = {HuggingFace},
  url       = {https://huggingface.co/datasets/Bateesa/preacher-tts-dataset}
}