開始使用免費開始

在有標籤的評論資料上比較模型

既然你已經能批次進行情緒分類,團隊想評估哪個模型更可靠。你將使用更大型、帶標籤的評論資料集來比較兩個模型,並衡量它們的準確率。

texts 清單及其對應的 true_labels 已為你預先載入。

本練習屬於課程

Python 的 Natural Language Processing(NLP)

檢視課程

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

from transformers import pipeline
from sklearn.metrics import accuracy_score
# Load sentiment analysis models
pipe_a = pipeline(task="sentiment-analysis", ____)
pipe_b = pipeline(task="sentiment-analysis", ____)

# Generate predictions
preds_a = [____ for res in pipe_a(texts)]
preds_b = [____ for res in pipe_b(texts)]
編輯並執行程式碼