Extrahera prompter
Du arbetar med datamängden hendrydong/rlhf_helpful_eval, som innehåller konversationstext mellan en användare (Human) och en assistent (Assistant). Målet är att rensa texten och ta fram en ren prompt där endast den relevanta texten visas, utan specifika mönster eller taggar.
Välj det alternativ du skulle använda för att rensa datamängden och extrahera prompterna. Du kan se ett utdrag av hur datamängden ser ut genom att köra följande kod i konsolen:
evaluation_data.iloc[range(1)]['text'][0]
Den här övningen är en del av kursen
Reinforcement Learning from Human Feedback (RLHF)
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen