計數文字(II)
一旦向量化器完成對資料的擬合,就可以用它把文字轉換成一個代表詞頻的陣列。這個陣列會以每個文字區塊為一列,以你在上一個練習觀察到、由向量化器產生的每個特徵為一欄。
你在上一個練習擬合的向量化器(cv)已經在你的工作環境中可用。
本練習屬於課程
Feature Engineering for Machine Learning in Python
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Apply the vectorizer
cv_transformed = ____(speech_df['text_clean'])
# Print the full array
cv_array = ____
print(cv_array)