НачатьНачать бесплатно

Попробуйте другое имя

Вы продолжаете работать над анализом тональности твитов и изучаете некоторые интересные детали. Вы заметили, что в отдельных твитах встречаются адреса электронной почты. Теперь вам интересно узнать, какое имя встречается чаще всего.

Вы хотите извлечь первую часть адреса электронной почты. Например, для адреса [email protected] вас интересует только часть marysmith90. Необходимо сопоставить всё выражение целиком, чтобы извлекать только имена из адресов электронной почты. При этом вас интересуют только имена, содержащие прописные (например, A, B, Z) или строчные буквы (например, a, d, z), а также цифры.

Список sentiment_analysis с текстами трёх твитов и модуль re уже загружены в вашу сессию. Вы можете воспользоваться функцией print(), чтобы просмотреть их в IPython Shell.

Это упражнение является частью курса

Регулярные выражения в Python

Посмотреть курс

Инструкции к упражнению

  • Дополните регулярное выражение так, чтобы оно совпадало с адресом электронной почты и захватывало только часть с именем. Имя располагается перед символом @.
  • Найдите все совпадения регулярного выражения в каждом элементе списка sentiment_analysis. Сохраните результат в переменную email_matched.
  • Дополните метод .format(), чтобы вывести результаты, захваченные в каждом элементе списка sentiment_analysis.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Редактировать и запускать код