在带标签的评论数据上比较模型
既然您已经可以批量进行情感分类,团队希望评估哪个模型更可靠。您将使用更大的带标签评论数据集比较两个模型,并测量它们的准确率。
系统已为您预加载了 texts 列表及其对应的 true_labels。
本练习是课程的一部分
Python 中的自然语言处理(NLP)
交互式实操练习
通过完成这段示例代码来试试这个练习。
from transformers import pipeline
from sklearn.metrics import accuracy_score
# Load sentiment analysis models
pipe_a = pipeline(task="sentiment-analysis", ____)
pipe_b = pipeline(task="sentiment-analysis", ____)
# Generate predictions
preds_a = [____ for res in pipe_a(texts)]
preds_b = [____ for res in pipe_b(texts)]