開始使用免費開始

理解 RLHF 中的比較與評分

現在換你來試試。假設你正在設計一個 AI 助手,需要了解使用者滿意度。你正考慮要蒐集「比較式回饋」,或改用「評分」。但兩者有什麼差異?每種方法都有其特色,選對方法會大幅影響產品的成效。

本練習屬於課程

Reinforcement Learning from Human Feedback(RLHF)

檢視課程

動手互動練習

將理論付諸實踐,立即體驗我們的互動練習

開始練習