CoolFace
Datasetpublic

sapinsapin/filipinospeechcorpus

Filipino Speech Corpus (FSC) Studio-recorded Filipino read, spontaneous, and word-level speech — 125 speakers, packaged as ready-to-stream Parquet. 313,322 transcribed segments · 65.1 hours · 125 speakers · 16kHz mono This is the Filipino Speech Corpus (Sagum), recorded in a controlled setting and hand/machine transcribed with Transcriber. This repo repackages the original .wav + .trs volumes as segment-level Parquet with inline audio, so you can stream it without… See the full description on the dataset page: https://huggingface.co/datasets/sapinsapin/filipinospeechcorpus.

sourceHugging Facemitupdated 2mo agoView on Hugging Face
3likes675downloads
settings

This repository belongs to sapinsapin on Hugging Face.

CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

namefilipinospeechcorpus
visibilitypublic
licencemit
gatedno
ownersapinsapin
Account settings
sapinsapin/filipinospeechcorpus · CoolFace