CoolFace
Modelpublic

textdetox/twitter-xlmr-toxicity-classifier

sourceHugging Faceopenrail++updated 1y agoView on Hugging Face
0likes754downloads
Model Card

Multilingual Toxicity Classifier for 15 Languages (2025)

This is an instance of cardiffnlp/twitter-xlm-roberta-large-2022 that was fine-tuned on binary toxicity classification task based on our updated (2025) dataset textdetox/multilingual_toxicity_dataset.

Now, the models covers 15 languages from various language families:

LanguageCodeF1 Score
Englishen0.9071
Russianru0.9022
Ukrainianuk0.9075
Germande0.6528
Spanishes0.7430
Arabicar0.6207
Amharicam0.6676
Hindihi0.7171
Chinesezh0.6483
Italianit0.7597
Frenchfr0.9114
Hinglishhin0.7051
Hebrewhe0.8911
Japaneseja0.8725
Tatartt0.6542

How to use

python
import torch
from transformers import AutoTokenizer, AutoModelForSequenceClassification

tokenizer = AutoTokenizer.from_pretrained('textdetox/twitter-xlmr-toxicity-classifier')
model = AutoModelForSequenceClassification.from_pretrained('textdetox/twitter-xlmr-toxicity-classifier')

batch = tokenizer.encode("You are amazing!", return_tensors="pt")

output = model(batch)
# idx 0 for neutral, idx 1 for toxic

Citation

The model is prepared for TextDetox 2025 Shared Task evaluation.

Citation TBD soon.