Začněte nyníZačněte zdarma

Extrakce promptů

Pracuješ s datasetem hendrydong/rlhf_helpful_eval, který obsahuje konverzační text mezi uživatelem (Human) a asistentem (Assistant). Tvým cílem je text vyčistit a připravit čistý prompt, ve kterém zůstane jen relevantní obsah bez specifických vzorů nebo tagů.

Vyber možnost, kterou bys použil/a k vyčištění datasetu a extrakci promptů. Ukázku toho, jak dataset vypadá, zobrazíš spuštěním následujícího kódu v konzoli:

evaluation_data.iloc[range(1)]['text'][0]

Toto cvičení je součástí kurzu

Reinforcement Learning from Human Feedback (RLHF)

Zobrazit kurz

Interaktivní praktické cvičení

Proměňte teorii v praxi s jedním z našich interaktivních cvičení

Začít cvičení