Вилучення пунктуації
Після того як ви вилучили стоп-слова з тексту відгуків, час обробити пунктуацію. Токени, які ви отримали у попередній вправі, усе ще містять розділові знаки, які зазвичай зайві під час категоризації відгуків.
Ваше завдання — вилучити пунктуацію зі списку наданих токенів, щоб ще краще очистити дані.
Ця вправа є частиною курсу
Natural Language Processing (NLP) in Python
Інструкції до вправи
- Очистіть список
filtered_tokens, вилучивши всі розділові знаки.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
import string
filtered_tokens = ['reached', 'support', 'got', 'helpful', 'response', 'within', 'minutes', '!', '!', '!', '#', 'impressed']
# Remove punctuation
clean_tokens = [____ for word in filtered_tokens if ____ not in ____.____]
print(clean_tokens)