jainsatyam26/prompt-injection-comparison
Prompt-Injection Model Comparison Compares 4 HuggingFace models on 2 prompt-injection benchmark datasets. Models Compared Model HF ID rogue-sentinel-v2 rogue-security/prompt-injection-jailbreak-sentinel-v2 protectai-deberta-v3 protectai/deberta-v3-base-prompt-injection-v2 qualifire-sentinel qualifire/prompt-injection-sentinel meta-prompt-guard-86M meta-llama/Prompt-Guard-86M Datasets rogue-security/prompt-injections-benchmark… See the full description on the dataset page: https://huggingface.co/datasets/jainsatyam26/prompt-injection-comparison.
015
Prompt-Injection Model Comparison
Compares 4 HuggingFace models on 2 prompt-injection benchmark datasets.
Models Compared
Datasets
- rogue-security/prompt-injections-benchmark (5000 samples)
- PromptINJECTIONAndBenignDATASET.jsonl (500 samples, multiple attack types)
Quick Start (single command)
git clone https://huggingface.co/datasets/jainsatyam26/prompt-injection-comparison
cd prompt-injection-comparison
bash run.sh YOUR_HF_TOKENOutputs
- results/summary.csv — per-model metrics (Accuracy, Precision, Recall, F1, FPR)
- results/detail_hf.csv — per-sample predictions on HF dataset
- results/detaillocal.csv — per-sample predictions + attacktype on local dataset
- results/report.txt — full ranked report
