Kom igångKom igång gratis

Jämförelse och betygsättning inom RLHF

Nu är det din tur. Föreställ dig att du designar en AI-assistent och behöver förstå användarnas nöjdhet. Du överväger att samla in jämförelsebaserad feedback eller, alternativt, betyg. Men vad är skillnaden mellan de två? Varje metod har sina egna egenskaper, och att välja rätt kan ha stor inverkan på produktens framgång.

Den här övningen är en del av kursen

Reinforcement Learning from Human Feedback (RLHF)

Visa kurs

Interaktiv övning med praktiskt arbete

Gör teori till handling med en av våra interaktiva övningar

Starta övningen