Sh1man/silero_open_stt
Usage from datasets import load_dataset, Audio dataset = load_dataset("Sh1man/silero_open_stt", "asr_calls_v2", split="train") print(dataset[0]['wav']) Subsets The dataset contains three subsets: asr_calls_v2: calls recordings buriy_audio_books_2: books recordings public_youtube700: youtube recordings 📊 Сводная статистика аудио-датасетов 📈 Общая статистика по всем датасетам Метрика Значение Всего датасетов/сабсетов 3… See the full description on the dataset page: https://huggingface.co/datasets/Sh1man/silero_open_stt.
428
Usage
from datasets import load_dataset, Audio
dataset = load_dataset("Sh1man/silero_open_stt", "asr_calls_v2", split="train")
print(dataset[0]['wav'])Subsets
The dataset contains three subsets:
- asr_calls_v2: calls recordings
- buriy_audio_books_2: books recordings
- public_youtube700: youtube recordings
📊 Сводная статистика аудио-датасетов
📈 Общая статистика по всем датасетам
Распределение объема данных по датасетам
asr_calls_v2 ██████████████████ 46.1%
buriy_audio_books_2 ███████████ 27.9%
public_youtube700 ██████████ 26.0%Датасет: asrcallsv2
Информация по сплитам
🔹 Тренировочный набор (train)
🔹 Валидационный набор (validate)
📊 Общая статистика датасета
Распределение данных по сплитам
train ████████████████████████ 60.0%
validate ████████████████ 40.0%Датасет: buriyaudiobooks_2
Информация по сплитам
🔹 Тренировочный набор (train)
🔹 Валидационный набор (validate)
📊 Общая статистика датасета
Распределение данных по сплитам
train ████████████████████████ 60.0%
validate ████████████████ 40.0%Датасет: public_youtube700
Информация по сплитам
🔹 Тренировочный набор (train)
🔹 Валидационный набор (validate)
📊 Общая статистика датасета
Распределение данных по сплитам
train ███████████████████████ 60.0%
validate ████████████████ 40.0%Licensing Information
CC-BY-NC Commercial usage available after agreement with dataset authors
