ZennyKenny/ru_virtual_assistant_chatgpt_distill
📊 Virtual Assistant Queries Dataset (Russian, Synthetic, 100K) Описание Этот датасет содержит 100,000 синтетически сгенерированных пользовательских запросов к виртуальному ассистенту на русском языке. Он предназначен для задач анализа пользовательского опыта, обработки естественного языка и предсказательного моделирования. Каждая запись представляет собой реалистичный запрос пользователя, категорию запроса, устройство, с которого он был сделан, и оценку качества… See the full description on the dataset page: https://huggingface.co/datasets/ZennyKenny/ru_virtual_assistant_chatgpt_distill.
📊 Virtual Assistant Queries Dataset (Russian, Synthetic, 100K)
Описание
Этот датасет содержит 100,000 синтетически сгенерированных пользовательских запросов к виртуальному ассистенту на русском языке. Он предназначен для задач анализа пользовательского опыта, обработки естественного языка и предсказательного моделирования.
Каждая запись представляет собой реалистичный запрос пользователя, категорию запроса, устройство, с которого он был сделан, и оценку качества полученного ответа.
Структура данных
Возможные применения
- Анализ удовлетворенности пользователей
- Классификация и категоризация запросов
- Моделирование зависимости между временем ответа и рейтингом
- Построение рекомендательных систем для виртуальных ассистентов
Пример
{
"user_id": "e6ba2828-a99b-409e-b987-7b7741d6973d",
"text": "Будет ли дождь на выходных?",
"category": "погода",
"response_time": 2.74,
"quality_rating": 7,
"device": "смартфон",
"task_successful": True
}Citation
@misc{virtualassistant2025russian,
title = {Virtual Assistant Queries Dataset (Russian, Synthetic)},
author = {Kenneth Hamilton},
year = {2025},
howpublished = {\url{https://huggingface.co/datasets/YourUsername/virtual-assistant-queries-ru}},
note = {Synthetic dataset of 100,000 Russian-language user queries to a virtual assistant. Includes realistic metadata for analysis and modeling. Created with Faker and pandas.}
}