ПочатиПочніть безкоштовно

Вилучення пунктуації

Після того як ви вилучили стоп-слова з тексту відгуків, час обробити пунктуацію. Токени, які ви отримали у попередній вправі, усе ще містять розділові знаки, які зазвичай зайві під час категоризації відгуків.

Ваше завдання — вилучити пунктуацію зі списку наданих токенів, щоб ще краще очистити дані.

Ця вправа є частиною курсу

Natural Language Processing (NLP) in Python

Переглянути курс

Інструкції до вправи

  • Очистіть список filtered_tokens, вилучивши всі розділові знаки.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

import string

filtered_tokens = ['reached', 'support', 'got', 'helpful', 'response', 'within', 'minutes', '!', '!', '!', '#', 'impressed']

# Remove punctuation
clean_tokens = [____ for word in filtered_tokens if ____ not in ____.____]

print(clean_tokens)
Редагувати та запускати код