Numărarea cuvintelor (II)
Odată ce vectorizatorul a fost antrenat pe date, poate fi folosit pentru a transforma textul într-un array care reprezintă numărul de apariții ale cuvintelor. Acest array va avea câte un rând pentru fiecare bloc de text și câte o coloană pentru fiecare dintre caracteristicile generate de vectorizator, pe care le-ai observat în exercițiul anterior.
Vectorizatorul pe care l-ai antrenat în exercițiul anterior (cv) este disponibil în spațiul tău de lucru.
Acest exercițiu face parte din cursul
Ingineria caracteristicilor pentru Machine Learning în Python
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Apply the vectorizer
cv_transformed = ____(speech_df['text_clean'])
# Print the full array
cv_array = ____
print(cv_array)