理解文本生成评估指标
在 PyBooks,团队刚用 BLEU 分数评估了一个预训练模型,结果约为 0.082,rouge1_fmeasure 约为 0.2692。该指标反映了精确率(选中的项目有多少是相关的)和召回率(相关的项目有多少被选中)。从模型性能的角度,您会如何解读这个分数?
本练习是课程的一部分
在 PyBooks,团队刚用 BLEU 分数评估了一个预训练模型,结果约为 0.082,rouge1_fmeasure 约为 0.2692。该指标反映了精确率(选中的项目有多少是相关的)和召回率(相关的项目有多少被选中)。从模型性能的角度,您会如何解读这个分数?
本练习是课程的一部分