Видобування підказок (prompts)
Ви працюєте з набором даних hendrydong/rlhf_helpful_eval, який містить розмовні тексти між користувачем (Human) і помічником (Assistant). Ваше завдання — очистити текст, підготувавши чисту підказку (prompt), де залишиться лише релевантний текст без специфічних шаблонів або тегів.
Виберіть варіант, який ви б використали, щоб очистити набір даних і видобути підказки. Ви можете переглянути фрагмент набору даних, запустивши в консолі такий код:
evaluation_data.iloc[range(1)]['text'][0]
Ця вправа є частиною курсу
Reinforcement Learning from Human Feedback (RLHF)
Практична інтерактивна вправа
Перетворіть теорію на практику за допомогою однієї з наших інтерактивних вправ
Почати вправу