НачатьНачать бесплатно

Подсчёт слов (II)

После того как векторизатор обучен на данных, его можно использовать для преобразования текста в массив, отражающий количество вхождений каждого слова. В этом массиве каждая строка соответствует одному блоку текста, а каждый столбец — одному из признаков, сгенерированных векторизатором в предыдущем упражнении.

Векторизатор, обученный в предыдущем упражнении (cv), доступен в вашем рабочем пространстве.

Это упражнение является частью курса

Конструирование признаков для машинного обучения в Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Apply the vectorizer
cv_transformed = ____(speech_df['text_clean'])

# Print the full array
cv_array = ____
print(cv_array)
Редактировать и запускать код