НачатьНачать бесплатно

Укажите шаблон токенов

В этом упражнении вы будете работать со столбцом text набора данных tweets. Ваша задача — векторизовать столбец с объектами с помощью CountVectorizer. Вы примените к векторизатору различные шаблоны токенов. Помните, что, задав шаблон токенов, можно отфильтровать ненужные символы.

CountVectorizer уже импортирован для вас.

Это упражнение является частью курса

Анализ тональности текста на Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Build and fit the vectorizer
vect = ____(____=r'\b[^\d\W][^\d\W]+\b').fit(tweets.text)
vect.transform(tweets.text)
print('Length of vectorizer: ', len(vect.get_feature_names()))
Редактировать и запускать код