Încearcă un alt nume
Continui să lucrezi la analiza sentimentelor pe Twitter. Analizezi acum câteva lucruri care ți-au atras atenția. Ai observat că în unele tweet-uri apar adrese de email. Acum ești curios/curioasă să afli care este cel mai frecvent nume.
Vrei să extragi prima parte a adresei de email. De exemplu, dacă ai emailul [email protected], ești interesat/interesată doar de marysmith90.
Trebuie să potrivești întreaga expresie, astfel încât să extragi doar numele prezente în adresele de email. De asemenea, ești interesat/interesată doar de numele care conțin litere mari (ex. A, B, Z) sau mici (ex. a, d, z) și cifre.
Lista sentiment_analysis care conține textul a trei tweet-uri, precum și modulul re, au fost încărcate în sesiunea ta. Poți folosi print() pentru a le vizualiza în Shell-ul IPython.
Acest exercițiu face parte din cursul
Expresii regulate în Python
Instrucțiuni pentru exercițiu
- Completează expresia regex pentru a potrivi emailul, capturând doar partea cu numele. Numele apare înaintea simbolului
@. - Găsește toate potrivirile expresiei regex în fiecare element al listei
sentiment_analysis. Atribuie rezultatul variabileiemail_matched. - Completează metoda
.format()pentru a afișa rezultatele capturate din fiecare element al listeisentiment_analysis.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))