Ta bort skiljetecken
Nu när du har tagit bort stoppord från feedbacktexten är det dags att hantera skiljetecken. Tokenerna du fick i föregående övning innehåller fortfarande skiljetecken, som ofta är onödiga när man kategoriserar feedback.
Din uppgift är att ta bort skiljetecken från listan med tokens för att rensa datan ytterligare.
Den här övningen är en del av kursen
Natural Language Processing (NLP) i Python
Övningsinstruktioner
- Rensa listan
filtered_tokensgenom att ta bort alla skiljetecken.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
import string
filtered_tokens = ['reached', 'support', 'got', 'helpful', 'response', 'within', 'minutes', '!', '!', '!', '#', 'impressed']
# Remove punctuation
clean_tokens = [____ for word in filtered_tokens if ____ not in ____.____]
print(clean_tokens)