ÎncepețiÎncepe gratuit

Eliminarea punctuației

Acum că ai eliminat cuvintele de oprire din textul de feedback, e momentul să te ocupi de punctuație. Tokenii obținuți în exercițiul anterior conțin în continuare semne de punctuație, care sunt adesea inutile atunci când clasifici feedback-ul.

Sarcina ta este să elimini punctuația din lista de tokeni furnizată, contribuind astfel la curățarea datelor în continuare.

Acest exercițiu face parte din cursul

Procesarea Limbajului Natural (NLP) în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Curăță lista filtered_tokens eliminând toate semnele de punctuație.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

import string

filtered_tokens = ['reached', 'support', 'got', 'helpful', 'response', 'within', 'minutes', '!', '!', '!', '#', 'impressed']

# Remove punctuation
clean_tokens = [____ for word in filtered_tokens if ____ not in ____.____]

print(clean_tokens)
Editează și rulează codul