lianghsun/zh-taiwan
Dataset Card for zh-taiwan zh-taiwan 是一個繁體中文之語音資料集,總計 2,740 筆音頻(train 2,698 / val 14 / test 28),音訊取樣率為 16 kHz。每筆資料包含音頻、音頻長度、繁體中文文本與對應之正規化(簡體)文本,適用於繁體中文之語音合成(TTS)或語音辨識(ASR)模型訓練與評測。 本資料集原始來源為 ivanzhu109/zh-taiwan,本 repository 僅作為鏡像與格式整理之版本,原始著作權歸原作者所有。 Dataset Details Dataset Description 本資料集提供 train / val / test 三個子集,每筆資料包含下列欄位: audio:16 kHz WAV 音頻; text:繁體中文文本,其中英文詞彙以全大寫形式保留(如 FIREFOXONANDROID、GOOGLE); normalized_text:對應之簡體中文正規化文本,保留相同英文大寫形式;… See the full description on the dataset page: https://huggingface.co/datasets/lianghsun/zh-taiwan.
This repository belongs to lianghsun on Hugging Face.
CoolFace never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.
