开始使用免费开始使用

词频统计(II)

一旦向量化器已在数据上完成拟合,就可以用它将文本转换为表示词频的数组。该数组按文本块进行行划分,并为您在上一个练习中看到的、由向量化器生成的每个特征提供一列。

您在上一个练习中拟合的向量化器(cv)已在您的工作空间中可用。

本练习是课程的一部分

Python 中的机器学习特征工程

查看课程

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Apply the vectorizer
cv_transformed = ____(speech_df['text_clean'])

# Print the full array
cv_array = ____
print(cv_array)
编辑并运行代码