Kom igångKom igång gratis

Extrahera prompter

Du arbetar med datamängden hendrydong/rlhf_helpful_eval, som innehåller konversationstext mellan en användare (Human) och en assistent (Assistant). Målet är att rensa texten och ta fram en ren prompt där endast den relevanta texten visas, utan specifika mönster eller taggar.

Välj det alternativ du skulle använda för att rensa datamängden och extrahera prompterna. Du kan se ett utdrag av hur datamängden ser ut genom att köra följande kod i konsolen:

evaluation_data.iloc[range(1)]['text'][0]

Den här övningen är en del av kursen

Reinforcement Learning from Human Feedback (RLHF)

Visa kurs

Interaktiv övning med praktiskt arbete

Gör teori till handling med en av våra interaktiva övningar

Starta övningen