Wypróbuj inne imię
Wciąż pracujesz nad analizą sentymentu na Twitterze. Tym razem przyglądasz się pewnym rzeczom, które zwróciły twoją uwagę. Zauważasz, że w niektórych tweetach pojawiają się adresy e-mail. Interesuje cię teraz znalezienie najczęściej występującej nazwy.
Chcesz wyodrębnić pierwszą część adresu e-mail. Na przykład dla adresu [email protected] interesuje cię wyłącznie fragment marysmith90.
Musisz dopasować całe wyrażenie, aby mieć pewność, że wyodrębniasz tylko nazwy obecne w adresach e-mail. Interesujesz się jedynie nazwami zawierającymi wielkie (np. A, B, Z) lub małe litery (np. a, d, z) oraz cyfry.
Lista sentiment_analysis zawierająca treść trzech tweetów oraz moduł re zostały wczytane do twojej sesji. Możesz użyć print(), aby wyświetlić jej zawartość w powłoce IPython.
To ćwiczenie jest częścią kursu
Wyrażenia regularne w Pythonie
Instrukcje do ćwiczenia
- Uzupełnij wyrażenie regularne tak, aby dopasowywało adres e-mail i przechwytywało wyłącznie część z nazwą. Nazwa pojawia się przed znakiem
@. - Znajdź wszystkie dopasowania wyrażenia regularnego w każdym elemencie listy
sentiment_analysis. Wynik przypisz do zmiennejemail_matched. - Uzupełnij metodę
.format(), aby wydrukować wyniki przechwycone z każdego elementu listysentiment_analysis.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))