CoolFace
Modelpublic

caeher/xlm-roberta-base-b2-sv

sourceHugging Facemitupdated 3d agoView on Hugging Face
0likes15downloads
Model Card

XLM-R base B2 — baseline de clasificación tóxica

Baseline multiclase para cuatro categorías:

  1. 1.No Tóxico
  2. 2.Lenguaje Ofensivo
  3. 3.Discurso de Odio
  4. 4.Amenazas/Violencia

Está basado en xlm-roberta-base y fue ajustado con el conjunto B2 del proyecto, usando texto_modelo, longitud máxima 128, cuatro épocas, tasa de aprendizaje 2e-5 y semilla 42. Su objetivo es servir como control frente a los modelos preentrenados específicamente sobre lenguaje de redes sociales.

Resultados de esta corrida

CorteF1 macroAccuracy
Validación (n=459)0.76690.7691
Test (n=460)0.79490.7957

IC bootstrap 95% del F1 de test: [0.7558, 0.8304]. Batería adversarial: 110/144. Sonda dirigida: 165/204.

Estas cifras corresponden a la corrida publicada y pueden diferir de otros experimentos del proyecto por versión de PyTorch, precisión mixta y hardware. El modelo es un baseline de comparación, no el modelo recomendado para uso operativo.

Uso

python
from transformers import pipeline

clf = pipeline("text-classification", model="caeher/xlm-roberta-base-b2-sv")
clf("texto de una publicación")

Este modelo no debe usarse como único criterio para moderación ni para tomar decisiones sobre personas; requiere revisión humana y evaluación específica del dominio.