CoolFace
Datasetpublic

kijjjj/audio_data_russian_backup

Dataset Audio Russian Backup This is a backup dataset with Russian audio data, split into train_0 to train_49 for tasks like text-to-speech, speech recognition, and speaker identification. Features text: Audio transcription (string). speaker_name: Speaker identifier (string). audio: Audio file. Usage Load the dataset like this: from datasets import load_dataset dataset = load_dataset("kijjjj/audio_data_russian_backup", split="train_0") # Or any… See the full description on the dataset page: https://huggingface.co/datasets/kijjjj/audio_data_russian_backup.

sourceHugging Facemitupdated 1y agoView on Hugging Face
0likes506downloads
Dataset Card

Dataset Audio Russian Backup

This is a backup dataset with Russian audio data, split into train0 to train49 for tasks like text-to-speech, speech recognition, and speaker identification.

Features

  • text: Audio transcription (string).
  • speaker_name: Speaker identifier (string).
  • audio: Audio file.

Usage

Load the dataset like this:

python
from datasets import load_dataset
dataset = load_dataset("kijjjj/audio_data_russian_backup", split="train_0")  # Or any train_X split
print(dataset[0])