ÎncepețiÎncepe gratuit

Încearcă un alt nume

Continui să lucrezi la analiza sentimentelor pe Twitter. Analizezi acum câteva lucruri care ți-au atras atenția. Ai observat că în unele tweet-uri apar adrese de email. Acum ești curios/curioasă să afli care este cel mai frecvent nume.

Vrei să extragi prima parte a adresei de email. De exemplu, dacă ai emailul [email protected], ești interesat/interesată doar de marysmith90.
Trebuie să potrivești întreaga expresie, astfel încât să extragi doar numele prezente în adresele de email. De asemenea, ești interesat/interesată doar de numele care conțin litere mari (ex. A, B, Z) sau mici (ex. a, d, z) și cifre.

Lista sentiment_analysis care conține textul a trei tweet-uri, precum și modulul re, au fost încărcate în sesiunea ta. Poți folosi print() pentru a le vizualiza în Shell-ul IPython.

Acest exercițiu face parte din cursul

Expresii regulate în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Completează expresia regex pentru a potrivi emailul, capturând doar partea cu numele. Numele apare înaintea simbolului @.
  • Găsește toate potrivirile expresiei regex în fiecare element al listei sentiment_analysis. Atribuie rezultatul variabilei email_matched.
  • Completează metoda .format() pentru a afișa rezultatele capturate din fiecare element al listei sentiment_analysis.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Editează și rulează codul