Liczenie słów (II)
Po dopasowaniu wektoryzatora do danych można go użyć do przekształcenia tekstu w tablicę reprezentującą liczby wystąpień słów. Tablica ta będzie miała po jednym wierszu na każdy blok tekstu i po jednej kolumnie dla każdej cechy wygenerowanej przez wektoryzator – tych, które zaobserwowałeś(-aś) w poprzednim ćwiczeniu.
Wektoryzator dopasowany w poprzednim ćwiczeniu (cv) jest dostępny w twoim środowisku pracy.
To ćwiczenie jest częścią kursu
Inżynieria cech w uczeniu maszynowym w Pythonie
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Apply the vectorizer
cv_transformed = ____(speech_df['text_clean'])
# Print the full array
cv_array = ____
print(cv_array)