Jämförelse och betygsättning inom RLHF
Nu är det din tur. Föreställ dig att du designar en AI-assistent och behöver förstå användarnas nöjdhet. Du överväger att samla in jämförelsebaserad feedback eller, alternativt, betyg. Men vad är skillnaden mellan de två? Varje metod har sina egna egenskaper, och att välja rätt kan ha stor inverkan på produktens framgång.
Den här övningen är en del av kursen
Reinforcement Learning from Human Feedback (RLHF)
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen