CoolFace
Datasetpublic

mteb/multi-hatecheck

MultiHateClassification An MTEB dataset Massive Text Embedding Benchmark Hate speech detection dataset with binary (hateful vs non-hateful) labels. Includes 25+ distinct types of hate and challenging non-hate, and 11 languages. Task category t2c Domains Constructed, Written Reference https://aclanthology.org/2022.woah-1.15/ How to evaluate on this task You can evaluate an embedding model on this dataset… See the full description on the dataset page: https://huggingface.co/datasets/mteb/multi-hatecheck.

sourceHugging Facecc-by-4.0updated 7mo agoView on Hugging Face
0likes722downloads
eval.yaml40 linesDownload Raw Back to root
1name: MultiHateClassification2description: Hate speech detection dataset with binary (hateful vs non-hateful) labels.3  Includes 25+ distinct types of hate and challenging non-hate, and 11 languages.4evaluation_framework: mteb5tasks:6- id: MultiHateClassification7- id: MultiHateClassification_ara_test8  config: ara9  split: test10- id: MultiHateClassification_cmn_test11  config: cmn12  split: test13- id: MultiHateClassification_eng_test14  config: eng15  split: test16- id: MultiHateClassification_deu_test17  config: deu18  split: test19- id: MultiHateClassification_fra_test20  config: fra21  split: test22- id: MultiHateClassification_hin_test23  config: hin24  split: test25- id: MultiHateClassification_ita_test26  config: ita27  split: test28- id: MultiHateClassification_nld_test29  config: nld30  split: test31- id: MultiHateClassification_pol_test32  config: pol33  split: test34- id: MultiHateClassification_por_test35  config: por36  split: test37- id: MultiHateClassification_spa_test38  config: spa39  split: test40