EmpezarEmpieza gratis

Comprender las métricas de generación de texto

En PyBooks, el equipo acaba de evaluar el rendimiento de un modelo preentrenado usando la puntuación BLEU y obtuvo un resultado de aproximadamente 0.082 y un rouge1_fmeasure de alrededor de 0.2692. Esta métrica indica la precisión (cuántos de los elementos seleccionados son relevantes) y la exhaustividad o recall (cuántos de los elementos relevantes se seleccionan). ¿Cómo interpretarías estas puntuaciones en términos del rendimiento del modelo?

Este ejercicio forma parte del curso

Deep Learning para texto con PyTorch

Ver curso

ejercicio interactivo práctico

Convierte la teoría en práctica con uno de nuestros ejercicios interactivos

Empezar ejercicio