词频统计(II)
一旦向量化器已在数据上完成拟合,就可以用它将文本转换为表示词频的数组。该数组按文本块进行行划分,并为您在上一个练习中看到的、由向量化器生成的每个特征提供一列。
您在上一个练习中拟合的向量化器(cv)已在您的工作空间中可用。
本练习是课程的一部分
Python 中的机器学习特征工程
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Apply the vectorizer
cv_transformed = ____(speech_df['text_clean'])
# Print the full array
cv_array = ____
print(cv_array)