Extrakce promptů
Pracuješ s datasetem hendrydong/rlhf_helpful_eval, který obsahuje konverzační text mezi uživatelem (Human) a asistentem (Assistant). Tvým cílem je text vyčistit a připravit čistý prompt, ve kterém zůstane jen relevantní obsah bez specifických vzorů nebo tagů.
Vyber možnost, kterou bys použil/a k vyčištění datasetu a extrakci promptů. Ukázku toho, jak dataset vypadá, zobrazíš spuštěním následujícího kódu v konzoli:
evaluation_data.iloc[range(1)]['text'][0]
Toto cvičení je součástí kurzu
Reinforcement Learning from Human Feedback (RLHF)
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení