Inizia subitoInizia gratis

Prova con un altro nome

Stai ancora lavorando all’analisi del sentiment su Twitter. Ora analizzi alcuni elementi che ti hanno colpito. Hai notato che in alcuni tweet sono inseriti degli indirizzi email. Sei curioso di scoprire qual è il nome più comune.

Vuoi estrarre la prima parte dell’email. Ad esempio, se hai l’email [email protected], ti interessa solo marysmith90. Devi far combaciare l’intera espressione, così da estrarre solo nomi presenti nelle email. Inoltre, ti interessano solo nomi che contengono lettere maiuscole (es. A, B, Z) o minuscole (es. a, d, z) e numeri.

La lista sentiment_analysis, che contiene il testo di tre tweet, così come il modulo re, sono già stati caricati nella tua sessione. Puoi usare print() per visualizzarla nell’IPython Shell.

Questo esercizio fa parte del corso

Espressioni regolari in Python

Visualizza corso

Istruzioni dell'esercizio

  • Completa la regex per far combaciare l’email catturando solo la parte del nome. La parte del nome compare prima della @.
  • Trova tutte le occorrenze della regex in ogni elemento di sentiment_analysis. Assegnale alla variabile email_matched.
  • Completa il metodo .format() per stampare i risultati catturati in ciascun elemento di sentiment_analysis.

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Modifica ed esegui il codice