始める無料で始める

学習→チューニング→フィードバック

あなたは、カスタマーサポートのパフォーマンスを最適化するために、人間のフィードバックによる強化学習(RLHF)を使ったモデル開発プロジェクトに取り組んでいます。

次の選択肢の中で、RLHFを最も正確に表しているものはどれですか?

この演習はコースの一部です

大規模言語モデル(LLM)の基本

コースを見る

実践的なインタラクティブ演習

理論を実践に変える、インタラクティブな演習のひとつをお試しください

演習を開始する