Porozumění metrikám pro generování textu
Tým v PyBooks právě vyhodnotil výkon předtrénovaného modelu pomocí skóre BLEU a dostal výsledek přibližně 0,082 a rouge1_fmeasure přibližně 0,2692. Tato metrika vyjadřuje přesnost (kolik vybraných položek je relevantních) a pokrytí (kolik relevantních položek bylo vybráno). Jak bys toto skóre interpretoval/a z hlediska výkonu modelu?
Toto cvičení je součástí kurzu
Deep Learning for Text with PyTorch
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení