Строковые операторы и Twitter
В этом упражнении вы примените различные строковые операторы к трём строкам, выбранным из набора данных tweets. Список tweets_list уже создан для вас.
Вам нужно построить три новых списка, применив разные строковые операторы:
- список, содержащий только буквы
- список, содержащий только символы
- список, содержащий только цифры
Необходимые функции уже импортированы из nltk.
Это упражнение является частью курса
Анализ тональности текста на Python
Инструкции к упражнению
- Создайте список токенов из
tweets_list. - В список
lettersвключите только буквы, исключив все цифры и прочие символы. - В
let_digitsоставьте буквенно-цифровые символы, удалив все остальные. - Создайте
digits, оставив только числа и убрав буквы и прочие символы.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Create a list of lists, containing the tokens from list_tweets
tokens = [____(item) for item in tweets_list]
# Remove characters and digits , i.e. retain only letters
letters = [[word for word in item if ____.____] for item in tokens]
# Remove characters, i.e. retain only letters and digits
let_digits = [[word for word in item if ____.____] for item in tokens]
# Remove letters and characters, retain only digits
digits = [[word for word in item if ____.____] for item in tokens]
# Print the last item in each list
print('Last item in alphabetic list: ', letters[2])
print('Last item in list of alphanumerics: ', let_digits[2])
print('Last item in the list of digits: ', digits[2])