CoolFace
Datasetpublic

jainsatyam26/prompt-injection-comparison

Prompt-Injection Model Comparison Compares 4 HuggingFace models on 2 prompt-injection benchmark datasets. Models Compared Model HF ID rogue-sentinel-v2 rogue-security/prompt-injection-jailbreak-sentinel-v2 protectai-deberta-v3 protectai/deberta-v3-base-prompt-injection-v2 qualifire-sentinel qualifire/prompt-injection-sentinel meta-prompt-guard-86M meta-llama/Prompt-Guard-86M Datasets rogue-security/prompt-injections-benchmark… See the full description on the dataset page: https://huggingface.co/datasets/jainsatyam26/prompt-injection-comparison.

sourceHugging Faceupdated 4mo agoView on Hugging Face
0likes15downloads
Dataset Card

Prompt-Injection Model Comparison

Compares 4 HuggingFace models on 2 prompt-injection benchmark datasets.

Models Compared

ModelHF ID
rogue-sentinel-v2rogue-security/prompt-injection-jailbreak-sentinel-v2
protectai-deberta-v3protectai/deberta-v3-base-prompt-injection-v2
qualifire-sentinelqualifire/prompt-injection-sentinel
meta-prompt-guard-86Mmeta-llama/Prompt-Guard-86M

Datasets

  1. 1.rogue-security/prompt-injections-benchmark (5000 samples)
  2. 2.PromptINJECTIONAndBenignDATASET.jsonl (500 samples, multiple attack types)

Quick Start (single command)

bash
git clone https://huggingface.co/datasets/jainsatyam26/prompt-injection-comparison
cd prompt-injection-comparison
bash run.sh YOUR_HF_TOKEN

Outputs

  • —results/summary.csv — per-model metrics (Accuracy, Precision, Recall, F1, FPR)
  • —results/detail_hf.csv — per-sample predictions on HF dataset
  • —results/detaillocal.csv — per-sample predictions + attacktype on local dataset
  • —results/report.txt — full ranked report