datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
illicit-general-multi-turn
Illicit General Multi-Turn Conversations
Multi-turn adversarial conversations that successfully elicited harmful illicit content from AI models. This sample dataset contains 5 conversations (52 turns) covering chemical weapons, cyber threats, and other safety-critical domains.
Dataset Statistics
Metric
Value
Conversations
5
Total Turns
52
Avg Turns/Conv
10.4
Harm Categories
3
Harm Categories
Category
Turns
Description
Chemical… See the full description on the dataset page: https://huggingface.co/datasets/GoJulyAI/illicit-general-multi-turn.illicit-bio-multi-turn
Illicit Bio Multi-Turn Conversations
Multi-turn adversarial conversations that successfully elicited harmful bio-safety content from AI models. This sample dataset contains 5 conversations (57 turns) covering bioweapons and related threats.
Dataset Statistics
Metric
Value
Conversations
5
Total Turns
57
Avg Turns/Conv
11.4
Harm Categories
3
Harm Categories
Category
Turns
Description
Bioweapons
34
Information about biological… See the full description on the dataset page: https://huggingface.co/datasets/GoJulyAI/illicit-bio-multi-turn.psychology-multi-turn
Psychology Multi-Turn Conversations
Multi-turn adversarial conversations that successfully elicited harmful psychological content from AI models. This sample dataset contains 5 conversations (54 turns) covering anthropomorphism, psychosis, self-harm, etc.
Dataset Statistics
Metric
Value
Conversations
5
Total Turns
54
Avg Turns/Conv
10.8
Harm Categories
3
Harm Categories
Category
Turns
Description
Anthropomorphism
28… See the full description on the dataset page: https://huggingface.co/datasets/GoJulyAI/psychology-multi-turn.
