mteb/multi-hatecheck
MultiHateClassification An MTEB dataset Massive Text Embedding Benchmark Hate speech detection dataset with binary (hateful vs non-hateful) labels. Includes 25+ distinct types of hate and challenging non-hate, and 11 languages. Task category t2c Domains Constructed, Written Reference https://aclanthology.org/2022.woah-1.15/ How to evaluate on this task You can evaluate an embedding model on this dataset… See the full description on the dataset page: https://huggingface.co/datasets/mteb/multi-hatecheck.
0722
1name: MultiHateClassification2description: Hate speech detection dataset with binary (hateful vs non-hateful) labels.3 Includes 25+ distinct types of hate and challenging non-hate, and 11 languages.4evaluation_framework: mteb5tasks:6- id: MultiHateClassification7- id: MultiHateClassification_ara_test8 config: ara9 split: test10- id: MultiHateClassification_cmn_test11 config: cmn12 split: test13- id: MultiHateClassification_eng_test14 config: eng15 split: test16- id: MultiHateClassification_deu_test17 config: deu18 split: test19- id: MultiHateClassification_fra_test20 config: fra21 split: test22- id: MultiHateClassification_hin_test23 config: hin24 split: test25- id: MultiHateClassification_ita_test26 config: ita27 split: test28- id: MultiHateClassification_nld_test29 config: nld30 split: test31- id: MultiHateClassification_pol_test32 config: pol33 split: test34- id: MultiHateClassification_por_test35 config: por36 split: test37- id: MultiHateClassification_spa_test38 config: spa39 split: test40 