datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
Disaster-tweet-jailbreakingHere the link to the paper: https://link.springer.com/chapter/10.1007/978-3-031-85240-4_14
jailbreaking_prompt_v2disaster-tweet-jailbreakingrt-inod-jailbreaking
JAILBREAKING dataset
Red teaming human-crafted jailbreaking dataset.
Usage
import datasets
dataset = datasets.load_dataset('innodatalabs/rt-inod-jailbreaking')
for item in dataset['train']:
print(item) # do the needful :)
License
This dataset is distributed under the terms of
CC BY-SA 4.0.
Citation
@misc{nadeau2024benchmarking,
title={Benchmarking Llama2, Mistral, Gemma and GPT for Factuality, Toxicity, Bias and Propensity for… See the full description on the dataset page: https://huggingface.co/datasets/innodatalabs/rt-inod-jailbreaking.jailbreaking_toxigenjailbreaking_toxsyn_gemma_llama_qwen_class_testejailbreaking_toxsyn_gemmajailbreaking_anotado_llamajailbreaking_toxsyn_qwen235_with_idtoxsyn_jailbreakings_classjailbreaking_toxigen_class_llama70toxsyn_jailbreakingsvul2prompt-jailbreaking-oss-11kJailbreaking-Synthetic-Datasetsjailbreaking_toxsyn_gemma_llamajailbreaking_prompts_v1jailbreaking_toxsyn_gemma2jailbreaking_toxsyn_gemmatestejailbreaking_toxigen_gemma_classjailbreakingjailbreaking_toxsyn_class_llama70safety_multimodal_jailbreakingsafety_corssmodel_jailbreakingsafety-eval-jailbreaking_promptssafety_typographic_jailbreakinglong_context_jailbreakingjailbreaking_toxsyn_gemma_llama_qwenWildChat-1M-Jailbreaking-Internaljailbreaking_toxsyn_gemma_llama_qwen_class
