Подготовка данных
Вы создаёте модель машинного обучения на основе NLP для проекта по анализу тональности текста. Задача модели — классифицировать отзывы о ресторанах как положительные, отрицательные или нейтральные. Чтобы подготовить данные к обучению, необходимо предобработать текст и представить его в числовом виде.
Ваш набор данных содержит тысячи отзывов, один из которых гласит:
«The food was delicious, but the service was extremely slow.»
Какой шаг предобработки текста с наибольшей вероятностью удалит слова «but» и «was» из этого отзыва?
Это упражнение является частью курса
Концепции больших языковых моделей (LLM)
Практическое интерактивное упражнение
Превратите теорию в практику с помощью одного из наших интерактивных упражнений
Начать упражнение