V3 RoBERTuito — discurso tóxico en redes sociales de El Salvador

Modelo de clasificación de secuencias en español para cuatro clases:

  1. No Tóxico
  2. Lenguaje Ofensivo
  3. Discurso de Odio
  4. Amenazas/Violencia

Está basado en pysentimiento/robertuito-base-cased y fue ajustado con el corpus V3 del proyecto, usando texto_modelo, longitud máxima 128 y pesos reducidos para ejemplos sintéticos. El artefacto publicado corresponde a la mediana de tres semillas (42, 1337 y 2026); en esta reconstrucción se eligió la semilla 2026 por F1 de validación.

Resultados

Corte F1 macro Accuracy
Validación (n=459) 0.8379 0.8410
Test (n=460) 0.8260 0.8283

IC bootstrap 95% del F1 de test: [0.7884, 0.8598].

Uso

from transformers import pipeline

clf = pipeline("text-classification", model="caeher/robertuito-v3-sv")
clf("texto de una publicación")

Para reproducir exactamente el preprocesamiento, normalice el texto con la versión 1.2 del proyecto antes de tokenizarlo. Este modelo no debe usarse como único criterio para moderación ni para decisiones sobre personas; requiere revisión humana y evaluación específica del dominio.

Datos y limitaciones

El conjunto contiene publicaciones públicas anonimizadas para entrenamiento, con lenguaje ofensivo y discurso de odio explícito. Las métricas dependen de la distribución del corpus y muestran una brecha entre X y Facebook. La sonda adversarial es diagnóstica, no sustituye al test independiente.

Downloads last month
14
Safetensors
Model size
0.1B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support