Začněte nyníZačněte zdarma

Skvělé!

Stále pracuješ na projektu analýzy sentimentu na Twitteru. Nejprve chceš identifikovat pozitivní tweety o filmech a koncertech.

Tvým cílem je najít všechny věty obsahující slova love, like nebo enjoy a toto slovo zachytit. Tweety omezíš na ty, které obsahují slova movie nebo concert – tato slova zachytíš v samostatné skupině. Zároveň uložíš název filmu nebo koncertu.

Například pro větu: I love the movie Avengers. zachytíš love, dále musíš zachytit movie a nakonec zachytíš vše až po tečku.

V prostředí máš k dispozici seznam sentiment_analysis s texty tří tweetů a modul re. Data si můžeš prohlédnout pomocí print() v IPython Shellu.

Toto cvičení je součástí kurzu

Regular Expressions in Python

Zobrazit kurz

Pokyny k cvičení

  • Doplň regulární výraz tak, aby zachytil slova love, like nebo enjoy. Zachyť slova movie nebo concert. Zachyť také vše, co se objeví až do znaku ..
  • Najdi všechny shody regexu v každém prvku seznamu sentiment_analysis a výsledky ulož do positive_matches.
  • Doplň metodu .format() tak, aby se vypsaly výsledky uložené v positive_matches pro každý prvek seznamu sentiment_analysis.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."

for tweet in sentiment_analysis:
	# Find all matches of regex in tweet
    positive_matches = re.____(____, ____)
    
    # Complete format to print out the results
    print("Positive comments found ____".format(____))
Upravit a spustit kód