Fuj! To pro mě není!
Poté, co jsi našel/a pozitivní tweety, chceš udělat totéž pro negativní. Tentokrát hledáš věty obsahující slova hate, dislike nebo disapprove. Opět budeš ukládat název filmu nebo koncertu. Tweet obsahující slova movie nebo concert sice zachytíš, ale tentokrát tato slova neplánuješ ukládat.
Například pro větu: I dislike the movie Avengers a lot. zachytíš slovo dislike. Slovo movie pouze porovnáš, ale nezachytíš. Poté zachytíš vše až do tečky.
V prostředí máš načtený seznam sentiment_analysis s texty tří tweetů a modul re. Data si můžeš prohlédnout pomocí print() v IPython Shellu.
Toto cvičení je součástí kurzu
Regular Expressions in Python
Pokyny k cvičení
- Doplň regulární výraz tak, aby zachytil slova
hate,dislikenebodisapprove. Slovamovieneboconcertporovnej, ale nezachycuj. Zachyť vše, co se objeví až do znaku.. - Najdi všechny shody regexu v každém prvku seznamu
sentiment_analysisa přiřaď je do proměnnénegative_matches. - Doplň metodu
.format()tak, aby se pro každý prvek vsentiment_analysisvytiskly výsledky uložené vnegative_matches.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Write a regex that matches sentences with the optional words
regex_negative = r"____.+?____\s____\."
for tweet in sentiment_analysis:
# Find all matches of regex in tweet
negative_matches = re.____(____, ____)
# Complete format to print out the results
print("Negative comments found ____".format(____))