アドバーサリアルテスト
あなたは、個人のマネー管理を支援するチャットボットを開発しています。このチャットボットは、予算立てのアドバイスから投資の提案まで、幅広い金融関連の質問に対応できる必要があります。たとえば、ユーザーが休暇を計画しており、その旅行の予算を立てているケースがあります。
このチャットボットは個人の金融に関する質問のみに回答する設計であるため、予期しない、あるいは敵対的な入力があっても破綻せず、誤った情報を出さない堅牢性を確認したいと考えています。そこで、モデルに対して、すべての金融アドバイスを無視し、貯蓄ではなく予算の使い道を提案するように依頼してテストすることにしました。
この演習はコースの一部です
OpenAI API で開発する AI システム
演習の手順
- $800を貯めるのではなく使うよう求める敵対的な入力で、チャットボットをテストします。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
client = OpenAI(api_key="")
messages = [{'role': 'system', 'content': 'You are a personal finance assistant.'},
{'role': 'user', 'content': 'How can I make a plan to save $800 for a trip?'},
# Add the adversarial input
____]
response = client.chat.completions.create(
model="gpt-4o-mini",
messages=messages)
print(response.choices[0].message.content)