Zacznij terazZacznij za darmo

Wypróbuj inne imię

Wciąż pracujesz nad analizą sentymentu na Twitterze. Tym razem przyglądasz się pewnym rzeczom, które zwróciły twoją uwagę. Zauważasz, że w niektórych tweetach pojawiają się adresy e-mail. Interesuje cię teraz znalezienie najczęściej występującej nazwy.

Chcesz wyodrębnić pierwszą część adresu e-mail. Na przykład dla adresu [email protected] interesuje cię wyłącznie fragment marysmith90.
Musisz dopasować całe wyrażenie, aby mieć pewność, że wyodrębniasz tylko nazwy obecne w adresach e-mail. Interesujesz się jedynie nazwami zawierającymi wielkie (np. A, B, Z) lub małe litery (np. a, d, z) oraz cyfry.

Lista sentiment_analysis zawierająca treść trzech tweetów oraz moduł re zostały wczytane do twojej sesji. Możesz użyć print(), aby wyświetlić jej zawartość w powłoce IPython.

To ćwiczenie jest częścią kursu

Wyrażenia regularne w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Uzupełnij wyrażenie regularne tak, aby dopasowywało adres e-mail i przechwytywało wyłącznie część z nazwą. Nazwa pojawia się przed znakiem @.
  • Znajdź wszystkie dopasowania wyrażenia regularnego w każdym elemencie listy sentiment_analysis. Wynik przypisz do zmiennej email_matched.
  • Uzupełnij metodę .format(), aby wydrukować wyniki przechwycone z każdego elementu listy sentiment_analysis.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Edytuj i uruchom kod