ПочатиПочніть безкоштовно

Видобування підказок (prompts)

Ви працюєте з набором даних hendrydong/rlhf_helpful_eval, який містить розмовні тексти між користувачем (Human) і помічником (Assistant). Ваше завдання — очистити текст, підготувавши чисту підказку (prompt), де залишиться лише релевантний текст без специфічних шаблонів або тегів.

Виберіть варіант, який ви б використали, щоб очистити набір даних і видобути підказки. Ви можете переглянути фрагмент набору даних, запустивши в консолі такий код:

evaluation_data.iloc[range(1)]['text'][0]

Ця вправа є частиною курсу

Reinforcement Learning from Human Feedback (RLHF)

Переглянути курс

Практична інтерактивна вправа

Перетворіть теорію на практику за допомогою однієї з наших інтерактивних вправ

Почати вправу