在有標籤的評論資料上比較模型
既然你已經能批次進行情緒分類,團隊想評估哪個模型更可靠。你將使用更大型、帶標籤的評論資料集來比較兩個模型,並衡量它們的準確率。
texts 清單及其對應的 true_labels 已為你預先載入。
本練習屬於課程
Python 的 Natural Language Processing(NLP)
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
from transformers import pipeline
from sklearn.metrics import accuracy_score
# Load sentiment analysis models
pipe_a = pipeline(task="sentiment-analysis", ____)
pipe_b = pipeline(task="sentiment-analysis", ____)
# Generate predictions
preds_a = [____ for res in pipe_a(texts)]
preds_b = [____ for res in pipe_b(texts)]