Prova con un altro nome
Stai ancora lavorando all’analisi del sentiment su Twitter. Ora analizzi alcuni elementi che ti hanno colpito. Hai notato che in alcuni tweet sono inseriti degli indirizzi email. Sei curioso di scoprire qual è il nome più comune.
Vuoi estrarre la prima parte dell’email. Ad esempio, se hai l’email [email protected], ti interessa solo marysmith90.
Devi far combaciare l’intera espressione, così da estrarre solo nomi presenti nelle email. Inoltre, ti interessano solo nomi che contengono lettere maiuscole (es. A, B, Z) o minuscole (es. a, d, z) e numeri.
La lista sentiment_analysis, che contiene il testo di tre tweet, così come il modulo re, sono già stati caricati nella tua sessione. Puoi usare print() per visualizzarla nell’IPython Shell.
Questo esercizio fa parte del corso
Espressioni regolari in Python
Istruzioni dell'esercizio
- Completa la regex per far combaciare l’email catturando solo la parte del nome. La parte del nome compare prima della
@. - Trova tutte le occorrenze della regex in ogni elemento di
sentiment_analysis. Assegnale alla variabileemail_matched. - Completa il metodo
.format()per stampare i risultati catturati in ciascun elemento disentiment_analysis.
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))