Ernesto-1997/Sarcastic_spanish_dataset
Viewer • Updated • 19.1k • 25 • 1
Fine-tuning de xlm-roberta-large sobre el dataset Sarcastic_spanish_dataset (Ernesto-1997).
Tarea: clasificación binaria (sarcasmo / no_sarcasmo).
Taller PLN - Maestría Ingeniería de Sistemas, Univalle.
| Batch | F1 | Precision | Recall | Accuracy |
|---|---|---|---|---|
| bs8 ⭐ | 0.9170 | 0.9201 | 0.9139 | 0.9351 |
| bs16 | 0.9104 | 0.9232 | 0.8979 | 0.9306 |
| bs32 | 0.9081 | 0.9199 | 0.8966 | 0.9288 |
from transformers import AutoModelForSequenceClassification, AutoTokenizer, pipeline
m = AutoModelForSequenceClassification.from_pretrained("cvalenciaunivalle/sarcasmo-xlm-roberta-large", subfolder="bs8")
t = AutoTokenizer.from_pretrained("cvalenciaunivalle/sarcasmo-xlm-roberta-large", subfolder="bs8")
pipe = pipeline("text-classification", model=m, tokenizer=t)
pipe("¡Qué divertido, otro lunes de trabajo!")
xlm-roberta-largeBase model
FacebookAI/xlm-roberta-large