kijjjj/audio_data_russian_backup
Dataset Audio Russian Backup This is a backup dataset with Russian audio data, split into train_0 to train_49 for tasks like text-to-speech, speech recognition, and speaker identification. Features text: Audio transcription (string). speaker_name: Speaker identifier (string). audio: Audio file. Usage Load the dataset like this: from datasets import load_dataset dataset = load_dataset("kijjjj/audio_data_russian_backup", split="train_0") # Or any… See the full description on the dataset page: https://huggingface.co/datasets/kijjjj/audio_data_russian_backup.
Dataset Audio Russian Backup
This is a backup dataset with Russian audio data, split into train0 to train49 for tasks like text-to-speech, speech recognition, and speaker identification.
Features
- text: Audio transcription (string).
- speaker_name: Speaker identifier (string).
- audio: Audio file.
Usage
Load the dataset like this:
from datasets import load_dataset
dataset = load_dataset("kijjjj/audio_data_russian_backup", split="train_0") # Or any train_X split
print(dataset[0])