Vikhrmodels/ToneBooksPlus
ToneBooksPlus ToneBooksPlus — расширенная версия датасета Vikhrmodels/ToneBooks, но без эмоциональной разметки. В датасете 179.16 часов аудио для train сплита и 9.42 часа для validation. Большое спасибо its5Q за помощь в сборе этих данных. Описание Для каждого аудиофрагмента собраны: Ссылка на MP3-файл (audio) Текстовая расшифровка (text) Имя голоса (voice_name) — одно из имён дикторов: Aleksandr Kotov Aleksandr Zbarovskii Alina Archibasova Daniel Che… See the full description on the dataset page: https://huggingface.co/datasets/Vikhrmodels/ToneBooksPlus.
ToneBooksPlus
ToneBooksPlus — расширенная версия датасета Vikhrmodels/ToneBooks, но без эмоциональной разметки. В датасете 179.16 часов аудио для train сплита и 9.42 часа для validation. Большое спасибо its5Q за помощь в сборе этих данных.
Описание
Для каждого аудиофрагмента собраны:
- Ссылка на MP3-файл (
audio) - Текстовая расшифровка (
text) - Имя голоса (
voice_name) — одно из имён дикторов: - Aleksandr Kotov
- Aleksandr Zbarovskii
- Alina Archibasova
- Daniel Che
- Evgenii Babincev
- Evgenii Lebedev
- Irina Bulekova
- Jam Nebesky
- Maksim Suslov
- Smelova S
- И другие
Формат записи (JSON)
{
"audio": "https://.../train/000001.mp3",
"text": "Сорокапятилетний Немцов был худощавым меланхоличным мужчиной, неинициативным, излишне осторожным.,
"voice_name": "dmitrii_shabrov"
}Пример использования
from datasets import load_dataset
ds = load_dataset("Vikhrmodels/ToneBooksPlus")