CoolFace
Datasetpublic

anna-sarvam/indic-safety-eval

IndicSafetyBench Multi-turn safety evaluation benchmark for Indian languages. Tests models against 30 jailbreak techniques across 19 India-specific harm domains in 23 languages with 189 dialect varieties. Stats 3,374 benchmark items 30 jailbreak techniques across 8 families 19 India harm domains (territorial, caste, religious, political, gender, etc.) 14 global harm categories (aligned with AILuminate v1.0 / Llama Guard 4) 23 languages (22 Indic + English) ~29%… See the full description on the dataset page: https://huggingface.co/datasets/anna-sarvam/indic-safety-eval.

sourceHugging Facecc-by-nc-4.0updated 3mo agoView on Hugging Face
0likes94downloads
Dataset Card

IndicSafetyBench

Multi-turn safety evaluation benchmark for Indian languages. Tests models against 30 jailbreak techniques across 19 India-specific harm domains in 23 languages with 189 dialect varieties.

Stats

  • —3,374 benchmark items
  • —30 jailbreak techniques across 8 families
  • —19 India harm domains (territorial, caste, religious, political, gender, etc.)
  • —14 global harm categories (aligned with AILuminate v1.0 / Llama Guard 4)
  • —23 languages (22 Indic + English)
  • —~29% tactic chains (3-4 techniques combined in multi-turn)

Usage

python
from datasets import load_dataset
bench = load_dataset("anna-sarvam/indic-safety-eval", split="train")

Columns

ColumnDescription
item_idUnique identifier
language, scriptTarget language and script
variety_id, variety_nameDialect variety
technique, technique_familyJailbreak technique and family
harm_categoryGlobal harm category (AILuminate-aligned)
india_domain, india_topicIndia-specific harm domain and topic
affected_groupsGroups affected by the harm
region, time_periodGeographic and temporal context
attack_angleHow the adversarial prompt approaches the topic
expected_behaviorExpected safe model response
num_turnsNumber of adversarial turns
tactic_chainWhether this is a multi-technique chain
turnsList of adversarial user messages to replay

Config Files

  • —configs/taxonomy.yaml -- 6-field harm taxonomy definition
  • —configs/techniques.yaml -- 30 jailbreak techniques with descriptions