Vyzkoušej jiné jméno
Stále pracuješ na analýze sentimentu tweetů. Teď se zaměříš na věci, které ti padly do oka. Všiml/a sis, že některé tweety obsahují e-mailové adresy. Zajímá tě, které jméno se vyskytuje nejčastěji.
Chceš extrahovat první část e-mailu. Například z adresy [email protected] tě zajímá pouze marysmith90.
Musíš zachytit celý výraz, abys získal/a pouze jména skutečně pocházející z e-mailových adres. Navíc tě zajímají jen jména tvořená velkými (např. A, B, Z) nebo malými písmeny (např. a, d, z) a číslicemi.
Seznam sentiment_analysis s texty tří tweetů a modul re jsou v prostředí načteny. Pro zobrazení v IPython Shellu můžeš použít print().
Toto cvičení je součástí kurzu
Regular Expressions in Python
Pokyny k cvičení
- Doplň regulární výraz tak, aby zachytil část e-mailu odpovídající jménu. Jméno se nachází před znakem
@. - Najdi všechny shody regulárního výrazu v každém prvku seznamu
sentiment_analysisa výsledek ulož do proměnnéemail_matched. - Doplň metodu
.format()tak, aby se vytiskly výsledky zachycené z každého prvku seznamusentiment_analysis.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))