开始使用免费开始使用

理解文本生成评估指标

在 PyBooks,团队刚用 BLEU 分数评估了一个预训练模型,结果约为 0.082,rouge1_fmeasure 约为 0.2692。该指标反映了精确率(选中的项目有多少是相关的)和召回率(相关的项目有多少被选中)。从模型性能的角度,您会如何解读这个分数?

本练习是课程的一部分

使用 PyTorch 的文本深度学习

查看课程

动手互动练习

通过我们的互动练习之一,将理论转化为实践

开始练习