Спробуйте інше ім'я
Ви все ще працюєте над аналізом тональності у Twitter. Тепер ви розбираєте деталі, які привернули вашу увагу. Ви помітили, що в деяких твітах вставлені адреси електронної пошти. Тепер вам цікаво з'ясувати, яке ім'я трапляється найчастіше.
Ви хочете витягти першу частину адреси. Наприклад, якщо є електронна адреса [email protected], вас цікавить лише marysmith90.
Вам потрібно зіставити весь вираз. Так ви переконаєтеся, що отримуєте лише імена, присутні в електронних адресах. Також вас цікавлять лише імена, що містять великі (наприклад, A, B, Z) або малі літери (наприклад, a, d, z) та цифри.
Список sentiment_analysis, що містить текст трьох твітів, а також модуль re уже завантажені у вашу сесію. Ви можете скористатися print(), щоб переглянути їх в IPython Shell.
Ця вправа є частиною курсу
Regular Expressions in Python
Інструкції до вправи
- Доповніть регулярний вираз, щоб зіставити адресу електронної пошти, захопивши лише частину імені. Частина імені розміщена перед
@. - Знайдіть усі збіги регулярного виразу в кожному елементі списку
sentiment_analysis. Присвойте їх зміннійemail_matched. - Доповніть метод
.format(), щоб надрукувати результати, захоплені в кожному елементі спискуsentiment_analysis.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))