CoolFace
Datasetpublic

Vikhrmodels/ToneBooksPlus

ToneBooksPlus ToneBooksPlus — расширенная версия датасета Vikhrmodels/ToneBooks, но без эмоциональной разметки. В датасете 179.16 часов аудио для train сплита и 9.42 часа для validation. Большое спасибо its5Q за помощь в сборе этих данных. Описание Для каждого аудиофрагмента собраны: Ссылка на MP3-файл (audio) Текстовая расшифровка (text) Имя голоса (voice_name) — одно из имён дикторов: Aleksandr Kotov Aleksandr Zbarovskii Alina Archibasova Daniel Che… See the full description on the dataset page: https://huggingface.co/datasets/Vikhrmodels/ToneBooksPlus.

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
7likes468downloads
Dataset Card

ToneBooksPlus

ToneBooksPlus — расширенная версия датасета Vikhrmodels/ToneBooks, но без эмоциональной разметки. В датасете 179.16 часов аудио для train сплита и 9.42 часа для validation. Большое спасибо its5Q за помощь в сборе этих данных.


Описание

Для каждого аудиофрагмента собраны:

  1. 1.Ссылка на MP3-файл (audio)
  2. 2.Текстовая расшифровка (text)
  3. 3.Имя голоса (voice_name) — одно из имён дикторов:
  4. 4.Aleksandr Kotov
  5. 5.Aleksandr Zbarovskii
  6. 6.Alina Archibasova
  7. 7.Daniel Che
  8. 8.Evgenii Babincev
  9. 9.Evgenii Lebedev
  10. 10.Irina Bulekova
  11. 11.Jam Nebesky
  12. 12.Maksim Suslov
  13. 13.Smelova S
  14. 14.И другие

Формат записи (JSON)

json
{
  "audio":           "https://.../train/000001.mp3",
  "text":            "Сорокапятилетний Немцов был худощавым меланхоличным мужчиной, неинициативным, излишне осторожным.,
  "voice_name":      "dmitrii_shabrov"
}

Пример использования

python
from datasets import load_dataset

ds = load_dataset("Vikhrmodels/ToneBooksPlus")