Eliminarea punctuației
Acum că ai eliminat cuvintele de oprire din textul de feedback, e momentul să te ocupi de punctuație. Tokenii obținuți în exercițiul anterior conțin în continuare semne de punctuație, care sunt adesea inutile atunci când clasifici feedback-ul.
Sarcina ta este să elimini punctuația din lista de tokeni furnizată, contribuind astfel la curățarea datelor în continuare.
Acest exercițiu face parte din cursul
Procesarea Limbajului Natural (NLP) în Python
Instrucțiuni pentru exercițiu
- Curăță lista
filtered_tokenseliminând toate semnele de punctuație.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
import string
filtered_tokens = ['reached', 'support', 'got', 'helpful', 'response', 'within', 'minutes', '!', '!', '!', '#', 'impressed']
# Remove punctuation
clean_tokens = [____ for word in filtered_tokens if ____ not in ____.____]
print(clean_tokens)