YenLuis/modelo-qa-beto-finetuned-pdqa
111
modelo-qa-beto-finetuned-pdqa
Modelo de Question Answering extractivo en español, afinado a partir de Lisibonny/modelo_qa_beto_squad_es_pdqa sobre el dataset Lisibonny/pdqa (noticias dominicanas).
Datos de entrenamiento
- Split oficial 45-15-20 (train-validation-test), estratificado por longitud de respuesta.
- Semilla: 420
Hiperparámetros
- Learning rate: 3e-05
- Épocas: 6
- Batch efectivo: 8
Resultados en validation
- Exact Match: 60.00
- F1: 76.93
Limitaciones conocidas
- Dataset pequeño (60 ejemplos combinados de train+validation), por lo que las métricas tienen alta varianza.
- El modelo puede tener dificultades con respuestas muy largas (listas de nombres, enumeraciones), aun con maxanswerlen ampliado.
