CoolFace
Datasetpublic

t0bi4s/vocalno

Tobias Chinese TTS Dataset 这是一个中文文本转语音(TTS)数据集,包含约997个高质量的中文音频-文本对。 数据集信息 语言: 中文 (Chinese) 任务: 文本转语音 (Text-to-Speech) 样本数量: ~997个音频-文本对 音频格式: WAV, 16kHz采样率 许可证: MIT 发言人: 单一发言人 数据集结构 from datasets import load_dataset # 加载完整数据集 dataset = load_dataset("your_username/tobias-tts-chinese") # 只加载训练集 train_dataset = load_dataset("your_username/tobias-tts-chinese", split="train") # 只加载验证集 validation_dataset =… See the full description on the dataset page: https://huggingface.co/datasets/t0bi4s/vocalno.

sourceHugging Facemitupdated 1y agoView on Hugging Face
0likes71downloads
Dataset Card

Tobias Chinese TTS Dataset

这是一个中文文本转语音(TTS)数据集,包含约997个高质量的中文音频-文本对。

数据集信息

  • —语言: 中文 (Chinese)
  • —任务: 文本转语音 (Text-to-Speech)
  • —样本数量: ~997个音频-文本对
  • —音频格式: WAV, 16kHz采样率
  • —许可证: MIT
  • —发言人: 单一发言人

数据集结构

python
from datasets import load_dataset

# 加载完整数据集
dataset = load_dataset("your_username/tobias-tts-chinese")

# 只加载训练集
train_dataset = load_dataset("your_username/tobias-tts-chinese", split="train")

# 只加载验证集
validation_dataset = load_dataset("your_username/tobias-tts-chinese", split="validation")

每个样本包含:

  • —text: 对应的中文文本
  • —audio: 音频数据,包含采样率和音频数组

使用示例

python
from datasets import load_dataset

# 加载数据集
dataset = load_dataset("your_username/tobias-tts-chinese")

# 查看数据集信息
print(dataset)

# 查看第一个样本
sample = dataset["train"][0]
print("文本:", sample['text'])
print("音频采样率:", sample['audio']['sampling_rate'])

# 播放音频
import soundfile as sf
sf.write("sample.wav", sample['audio']['array'], sample['audio']['sampling_rate'])

数据集统计

  • —训练集: ~897 样本
  • —验证集: ~99 样本
  • —平均音频长度: 约3-8秒
  • —文本语言: 简体中文

引用

如果您使用了这个数据集,请适当引用。

许可证

本数据集基于MIT许可证发布。使用时请遵守相关法律法规。