ジムのキャンペーン用スローガンの比較
あなたは広告代理店と協力して、ジムのキャンペーン用スローガンを生成する2つのモデルを評価しています。各モデルは、対応する効果スコア付きのスローガン一覧を生成しました。あなたのタスクは、各モデルが生成したスローガンを比較し、どちらのモデルが全体として優れているかを判断し、各モデルの成功率を計算することです。
スローガンはあらかじめ slogans_X と slogans_Y に読み込まれており、スローガンとそのスコアを含むタプルのリストになっています。
この演習はコースの一部です
人間のフィードバックによる強化学習(RLHF)
演習の手順
- 各スローガンのペアについて、スローガンXのスコアが高ければ
wins_Xを 1 増やし、スローガンYのスコアが高ければwins_Yを 1 増やしてください。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
def evaluate_slogans(slogans_X, slogans_Y):
wins_X, wins_Y = 0, 0
for (slogan_X, score_X), (slogan_Y, score_Y) in zip(slogans_X, slogans_Y):
# Assign one point to X if score X is higher, otherwise to Y
____
success_rate_X = (wins_X / len(slogans_X)) * 100
success_rate_Y = (wins_Y / len(slogans_Y)) * 100
return success_rate_X, success_rate_Y
results = evaluate_slogans(slogans_X, slogans_Y)
print(f"The resulting scores are {results}")