НачатьНачать бесплатно

Строковые операторы и Twitter

В этом упражнении вы примените различные строковые операторы к трём строкам, выбранным из набора данных tweets. Список tweets_list уже создан для вас.

Вам нужно построить три новых списка, применив разные строковые операторы:

  • список, содержащий только буквы
  • список, содержащий только символы
  • список, содержащий только цифры

Необходимые функции уже импортированы из nltk.

Это упражнение является частью курса

Анализ тональности текста на Python

Посмотреть курс

Инструкции к упражнению

  • Создайте список токенов из tweets_list.
  • В список letters включите только буквы, исключив все цифры и прочие символы.
  • В let_digits оставьте буквенно-цифровые символы, удалив все остальные.
  • Создайте digits, оставив только числа и убрав буквы и прочие символы.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Create a list of lists, containing the tokens from list_tweets
tokens = [____(item) for item in tweets_list]

# Remove characters and digits , i.e. retain only letters
letters = [[word for word in item if ____.____] for item in tokens]
# Remove characters, i.e. retain only letters and digits
let_digits = [[word for word in item if ____.____] for item in tokens]
# Remove letters and characters, retain only digits
digits = [[word for word in item if ____.____] for item in tokens]

# Print the last item in each list
print('Last item in alphabetic list: ', letters[2])
print('Last item in list of alphanumerics: ', let_digits[2])
print('Last item in the list of digits: ', digits[2])
Редактировать и запускать код