ÎncepețiÎncepe gratuit

Extragerea prompturilor

Lucrezi cu setul de date hendrydong/rlhf_helpful_eval, care conține text conversațional între un utilizator (Human) și un asistent (Assistant). Scopul tău este să cureți textul și să obții un prompt curat, în care să apară doar textul relevant, fără tipare sau etichete specifice.

Alege opțiunea pe care ai folosi-o pentru a curăța setul de date și a extrage prompturile. Poți vedea un fragment din setul de date rulând următorul cod în consolă:

evaluation_data.iloc[range(1)]['text'][0]

Acest exercițiu face parte din cursul

Reinforcement Learning from Human Feedback (RLHF)

Vezi cursul

Exercițiu interactiv practic

Transformă teoria în practică cu unul dintre exercițiile noastre interactive

Începe exercițiul