Začněte nyníZačněte zdarma

Vyzkoušej jiné jméno

Stále pracuješ na analýze sentimentu tweetů. Teď se zaměříš na věci, které ti padly do oka. Všiml/a sis, že některé tweety obsahují e-mailové adresy. Zajímá tě, které jméno se vyskytuje nejčastěji.

Chceš extrahovat první část e-mailu. Například z adresy [email protected] tě zajímá pouze marysmith90. Musíš zachytit celý výraz, abys získal/a pouze jména skutečně pocházející z e-mailových adres. Navíc tě zajímají jen jména tvořená velkými (např. A, B, Z) nebo malými písmeny (např. a, d, z) a číslicemi.

Seznam sentiment_analysis s texty tří tweetů a modul re jsou v prostředí načteny. Pro zobrazení v IPython Shellu můžeš použít print().

Toto cvičení je součástí kurzu

Regular Expressions in Python

Zobrazit kurz

Pokyny k cvičení

  • Doplň regulární výraz tak, aby zachytil část e-mailu odpovídající jménu. Jméno se nachází před znakem @.
  • Najdi všechny shody regulárního výrazu v každém prvku seznamu sentiment_analysis a výsledek ulož do proměnné email_matched.
  • Doplň metodu .format() tak, aby se vytiskly výsledky zachycené z každého prvku seznamu sentiment_analysis.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Upravit a spustit kód