Skvělé!
Stále pracuješ na projektu analýzy sentimentu na Twitteru. Nejprve chceš identifikovat pozitivní tweety o filmech a koncertech.
Tvým cílem je najít všechny věty obsahující slova love, like nebo enjoy a toto slovo zachytit. Tweety omezíš na ty, které obsahují slova movie nebo concert – tato slova zachytíš v samostatné skupině. Zároveň uložíš název filmu nebo koncertu.
Například pro větu: I love the movie Avengers. zachytíš love, dále musíš zachytit movie a nakonec zachytíš vše až po tečku.
V prostředí máš k dispozici seznam sentiment_analysis s texty tří tweetů a modul re. Data si můžeš prohlédnout pomocí print() v IPython Shellu.
Toto cvičení je součástí kurzu
Regular Expressions in Python
Pokyny k cvičení
- Doplň regulární výraz tak, aby zachytil slova
love,likeneboenjoy. Zachyť slovamovieneboconcert. Zachyť také vše, co se objeví až do znaku.. - Najdi všechny shody regexu v každém prvku seznamu
sentiment_analysisa výsledky ulož dopositive_matches. - Doplň metodu
.format()tak, aby se vypsaly výsledky uložené vpositive_matchespro každý prvek seznamusentiment_analysis.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."
for tweet in sentiment_analysis:
# Find all matches of regex in tweet
positive_matches = re.____(____, ____)
# Complete format to print out the results
print("Positive comments found ____".format(____))