CoolFace
Datasetpublic

erenfazlioglu/turkishvoicedataset

Dataset Card for "turkishneuralvoice" Dataset Overview Dataset Name: Turkish Neural Voice Description: This dataset contains Turkish audio samples generated using Microsoft Text to Speech services. The dataset includes audio files and their corresponding transcriptions. Dataset Structure Configs: default Data Files: Split: train Path: data/train-* Dataset Info: Features: audio: Audio file transcription: Corresponding text transcription… See the full description on the dataset page: https://huggingface.co/datasets/erenfazlioglu/turkishvoicedataset.

sourceHugging Facecc-by-nc-4.0updated 2y agoView on Hugging Face
44likes318downloads
Dataset Card

Dataset Card for "turkishneuralvoice"

Dataset Overview

Dataset Name: Turkish Neural Voice

Description: This dataset contains Turkish audio samples generated using Microsoft Text to Speech services. The dataset includes audio files and their corresponding transcriptions.

Dataset Structure

Configs:

  • —default

Data Files:

  • —Split: train
  • —Path: data/train-*

Dataset Info:

  • —Features:
  • —audio: Audio file
  • —transcription: Corresponding text transcription
  • —Splits:
  • —train
  • —Number of bytes: 5,933,166,725.824
  • —Number of examples: 130,634
  • —Download Size: 5,547,933,432 bytes
  • —Dataset Size: 5,933,166,725.824 bytes

Usage

To load this dataset in your Python environment using Hugging Face's datasets library, use the following code:

python
from datasets import load_dataset

dataset = load_dataset("path/to/dataset/turkishneuralvoice")