CoolFace
Datasetpublic

ZennyKenny/ru_virtual_assistant_chatgpt_distill

📊 Virtual Assistant Queries Dataset (Russian, Synthetic, 100K) Описание Этот датасет содержит 100,000 синтетически сгенерированных пользовательских запросов к виртуальному ассистенту на русском языке. Он предназначен для задач анализа пользовательского опыта, обработки естественного языка и предсказательного моделирования. Каждая запись представляет собой реалистичный запрос пользователя, категорию запроса, устройство, с которого он был сделан, и оценку качества… See the full description on the dataset page: https://huggingface.co/datasets/ZennyKenny/ru_virtual_assistant_chatgpt_distill.

sourceHugging Facemitupdated 1y agoView on Hugging Face
3likes22downloads
Dataset Card

📊 Virtual Assistant Queries Dataset (Russian, Synthetic, 100K)

Описание

Этот датасет содержит 100,000 синтетически сгенерированных пользовательских запросов к виртуальному ассистенту на русском языке. Он предназначен для задач анализа пользовательского опыта, обработки естественного языка и предсказательного моделирования.

Каждая запись представляет собой реалистичный запрос пользователя, категорию запроса, устройство, с которого он был сделан, и оценку качества полученного ответа.

Структура данных

ПолеОписание
user_idУникальный идентификатор пользователя
textТекст запроса на русском языке
categoryКатегория запроса (например, "погода", "музыка", "финансы")
response_timeВремя ответа ассистента в секундах
quality_ratingОценка качества ответа от 1 до 10
deviceТип устройства, с которого был сделан запрос
task_successfulФлаг успешного выполнения задачи (True / False)

Возможные применения

  • Анализ удовлетворенности пользователей
  • Классификация и категоризация запросов
  • Моделирование зависимости между временем ответа и рейтингом
  • Построение рекомендательных систем для виртуальных ассистентов

Пример

python
{
  "user_id": "e6ba2828-a99b-409e-b987-7b7741d6973d",
  "text": "Будет ли дождь на выходных?",
  "category": "погода",
  "response_time": 2.74,
  "quality_rating": 7,
  "device": "смартфон",
  "task_successful": True
}

Citation

@misc{virtualassistant2025russian,
  title        = {Virtual Assistant Queries Dataset (Russian, Synthetic)},
  author       = {Kenneth Hamilton},
  year         = {2025},
  howpublished = {\url{https://huggingface.co/datasets/YourUsername/virtual-assistant-queries-ru}},
  note         = {Synthetic dataset of 100,000 Russian-language user queries to a virtual assistant. Includes realistic metadata for analysis and modeling. Created with Faker and pandas.}
}