НачатьНачать бесплатно

Подготовка данных

Вы создаёте модель машинного обучения на основе NLP для проекта по анализу тональности текста. Задача модели — классифицировать отзывы о ресторанах как положительные, отрицательные или нейтральные. Чтобы подготовить данные к обучению, необходимо предобработать текст и представить его в числовом виде.

Ваш набор данных содержит тысячи отзывов, один из которых гласит:

«The food was delicious, but the service was extremely slow.»

Какой шаг предобработки текста с наибольшей вероятностью удалит слова «but» и «was» из этого отзыва?

Это упражнение является частью курса

Концепции больших языковых моделей (LLM)

Посмотреть курс

Практическое интерактивное упражнение

Превратите теорию в практику с помощью одного из наших интерактивных упражнений

Начать упражнение