Înțelegerea metricilor pentru generarea de text
La PyBooks, echipa tocmai a evaluat performanța unui model preantrenat folosind scorul BLEU și a obținut un rezultat de aproximativ 0,082, respectiv un rouge1_fmeasure de aproximativ 0,2692. Această metrică reflectă precizia (câte dintre elementele selectate sunt relevante) și recuperarea (câte dintre elementele relevante sunt selectate). Cum ai interpreta aceste scoruri în ceea ce privește performanța modelului?
Acest exercițiu face parte din cursul
Deep Learning pentru text cu PyTorch
Exercițiu interactiv practic
Transformă teoria în practică cu unul dintre exercițiile noastre interactive
Începe exercițiul