erenfazlioglu/turkishvoicedataset
Dataset Card for "turkishneuralvoice" Dataset Overview Dataset Name: Turkish Neural Voice Description: This dataset contains Turkish audio samples generated using Microsoft Text to Speech services. The dataset includes audio files and their corresponding transcriptions. Dataset Structure Configs: default Data Files: Split: train Path: data/train-* Dataset Info: Features: audio: Audio file transcription: Corresponding text transcription… See the full description on the dataset page: https://huggingface.co/datasets/erenfazlioglu/turkishvoicedataset.
Dataset Card for "turkishneuralvoice"
Dataset Overview
Dataset Name: Turkish Neural Voice
Description: This dataset contains Turkish audio samples generated using Microsoft Text to Speech services. The dataset includes audio files and their corresponding transcriptions.
Dataset Structure
Configs:
default
Data Files:
- Split:
train - Path:
data/train-*
Dataset Info:
- Features:
audio: Audio filetranscription: Corresponding text transcription- Splits:
train- Number of bytes:
5,933,166,725.824 - Number of examples:
130,634 - Download Size:
5,547,933,432bytes - Dataset Size:
5,933,166,725.824bytes
Usage
To load this dataset in your Python environment using Hugging Face's datasets library, use the following code:
from datasets import load_dataset
dataset = load_dataset("path/to/dataset/turkishneuralvoice")