Extragerea prompturilor
Lucrezi cu setul de date hendrydong/rlhf_helpful_eval, care conține text conversațional între un utilizator (Human) și un asistent (Assistant). Scopul tău este să cureți textul și să obții un prompt curat, în care să apară doar textul relevant, fără tipare sau etichete specifice.
Alege opțiunea pe care ai folosi-o pentru a curăța setul de date și a extrage prompturile. Poți vedea un fragment din setul de date rulând următorul cod în consolă:
evaluation_data.iloc[range(1)]['text'][0]
Acest exercițiu face parte din cursul
Reinforcement Learning from Human Feedback (RLHF)
Exercițiu interactiv practic
Transformă teoria în practică cu unul dintre exercițiile noastre interactive
Începe exercițiul