hsbharadwaj/toxic-vs-clean-dataset
Dataset Name: Toxic vs Clean Text Dataset Описание Данный датасет предназначен для обучения бинарного классификатора текстовой безопасности (выявление токсичности, вредоносного контента и скрытых промпт-инъекций). Структура данных Датасет разделен на три сплита (train, validation, test) в пропорции 80/10/10 с сохранением стратификации классов. Каждый сплит содержит колонки: text (string): Текст запроса или команды. label (int): Метка класса (0 —… See the full description on the dataset page: https://huggingface.co/datasets/hsbharadwaj/toxic-vs-clean-dataset.
Conversations for this repository live on Hugging Face.
CoolFace shows imported repositories read-only. Posting into someone else’s repository from here would need an authorised integration and the account holder’s consent, so the link goes to the source instead.
Open discussions on Hugging Face