ПочатиПочніть безкоштовно

Спробуйте інше ім'я

Ви все ще працюєте над аналізом тональності у Twitter. Тепер ви розбираєте деталі, які привернули вашу увагу. Ви помітили, що в деяких твітах вставлені адреси електронної пошти. Тепер вам цікаво з'ясувати, яке ім'я трапляється найчастіше.

Ви хочете витягти першу частину адреси. Наприклад, якщо є електронна адреса [email protected], вас цікавить лише marysmith90. Вам потрібно зіставити весь вираз. Так ви переконаєтеся, що отримуєте лише імена, присутні в електронних адресах. Також вас цікавлять лише імена, що містять великі (наприклад, A, B, Z) або малі літери (наприклад, a, d, z) та цифри.

Список sentiment_analysis, що містить текст трьох твітів, а також модуль re уже завантажені у вашу сесію. Ви можете скористатися print(), щоб переглянути їх в IPython Shell.

Ця вправа є частиною курсу

Regular Expressions in Python

Переглянути курс

Інструкції до вправи

  • Доповніть регулярний вираз, щоб зіставити адресу електронної пошти, захопивши лише частину імені. Частина імені розміщена перед @.
  • Знайдіть усі збіги регулярного виразу в кожному елементі списку sentiment_analysis. Присвойте їх змінній email_matched.
  • Доповніть метод .format(), щоб надрукувати результати, захоплені в кожному елементі списку sentiment_analysis.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Редагувати та запускати код