開始使用免費開始

理解文字生成評估指標

在 PyBooks,團隊剛用 BLEU 分數評估一個預訓練模型的效能,結果約為 0.082,rouge1_fmeasure 約為 0.2692。這些指標分別反映精確率(挑選出的項目有多少是相關的)與召回率(相關的項目中有多少被挑選到)。就模型表現而言,你會如何解讀這些分數?

本練習屬於課程

Deep Learning for Text with PyTorch

檢視課程

動手互動練習

將理論付諸實踐,立即體驗我們的互動練習

開始練習