开始使用免费开始使用

在带标签的评论数据上比较模型

既然您已经可以批量进行情感分类,团队希望评估哪个模型更可靠。您将使用更大的带标签评论数据集比较两个模型,并测量它们的准确率。

系统已为您预加载了 texts 列表及其对应的 true_labels

本练习是课程的一部分

Python 中的自然语言处理(NLP)

查看课程

交互式实操练习

通过完成这段示例代码来试试这个练习。

from transformers import pipeline
from sklearn.metrics import accuracy_score
# Load sentiment analysis models
pipe_a = pipeline(task="sentiment-analysis", ____)
pipe_b = pipeline(task="sentiment-analysis", ____)

# Generate predictions
preds_a = [____ for res in pipe_a(texts)]
preds_b = [____ for res in pipe_b(texts)]
编辑并运行代码