datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
kaggle-toxic-annotated-filteredfiltered_toxic_sampleskinopotok-support-toxic-filter_2
Dataset Card for "kinopotok-support-toxic-filter_2"
Обзор датасета
Этот датасет предназначен для обучения и валидации моделей многотикеточной классификации (Multi-label Classification) токсичного русскоязычного контента. Данные размечены по трем независимым бизнес-категориям модерации.
Структура данных
Каждый объект датасета содержит очищенный текст комментария и три бинарные метки:
text (string): Очищенный текст комментария пользователя.
profanity… See the full description on the dataset page: https://huggingface.co/datasets/AlucardV/kinopotok-support-toxic-filter_2.
