Comprender las métricas de generación de texto
En PyBooks, el equipo acaba de evaluar el rendimiento de un modelo preentrenado usando la puntuación BLEU y obtuvo un resultado de aproximadamente 0.082 y un rouge1_fmeasure de alrededor de 0.2692. Esta métrica indica la precisión (cuántos de los elementos seleccionados son relevantes) y la exhaustividad o recall (cuántos de los elementos relevantes se seleccionan). ¿Cómo interpretarías estas puntuaciones en términos del rendimiento del modelo?
Este ejercicio forma parte del curso
Deep Learning para texto con PyTorch
ejercicio interactivo práctico
Convierte la teoría en práctica con uno de nuestros ejercicios interactivos
Empezar ejercicio