Більше операторів для рядків і Twitter
У цій вправі ви застосуєте різні оператори для рядків до трьох рядків, вибраних із набору даних tweets. Список tweets_list уже створено для вас.
Вам потрібно побудувати три нові списки, застосувавши різні оператори для рядків:
- список, у якому збережено лише літери
- список, у якому збережено лише символи
- список, у якому збережено лише цифри
Необхідні функції було імпортовано для вас з nltk.
Ця вправа є частиною курсу
Аналіз тональності в Python
Інструкції до вправи
- Створіть список токенів із
tweets_list. - У списку
lettersвидаліть усі цифри та інші символи, тобто залиште лише літери. - У
let_digitsзбережіть буквено-цифрові символи, але видаліть усі інші символи. - Створіть
digits, видаливши літери та символи й залишивши лише числа.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Create a list of lists, containing the tokens from list_tweets
tokens = [____(item) for item in tweets_list]
# Remove characters and digits , i.e. retain only letters
letters = [[word for word in item if ____.____] for item in tokens]
# Remove characters, i.e. retain only letters and digits
let_digits = [[word for word in item if ____.____] for item in tokens]
# Remove letters and characters, retain only digits
digits = [[word for word in item if ____.____] for item in tokens]
# Print the last item in each list
print('Last item in alphabetic list: ', letters[2])
print('Last item in list of alphanumerics: ', let_digits[2])
print('Last item in the list of digits: ', digits[2])