Love it!
Je werkt nog steeds aan het Twitter-sentimentanalyseproject. Eerst wil je positieve tweets over films en concerten herkennen.
Je wilt alle zinnen vinden die de woorden love, like of enjoy bevatten en dat woord vastleggen. Je beperkt de tweets door je te richten op die met de woorden movie of concert en houdt dat woord in een andere groep vast. Ook sla je de naam van de film of het concert op.
Bijvoorbeeld, als je de zin hebt: I love the movie Avengers. Dan match en leg je love vast. Je moet ook movie matchen en vastleggen. Daarna match en leg je alles vast tot aan de punt.
De lijst sentiment_analysis met de tekst van drie tweets en de module re zijn in je sessie geladen. Je kunt print() gebruiken om de gegevens in de IPython Shell te bekijken.
Deze oefening maakt deel uit van de cursus
Regular expressions in Python
Oefeninstructies
- Maak de reguliere expressie af om de woorden
loveoflikeofenjoyvast te leggen. Match en leg de woordenmovieofconcertvast. Match en leg alles vast wat verschijnt tot aan de.. - Vind alle matches van de regex in elk element van
sentiment_analysis. Wijs ze toe aanpositive_matches. - Maak de
.format()-methode af om de resultaten inpositive_matchesaf te drukken voor elk element insentiment_analysis.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."
for tweet in sentiment_analysis:
# Find all matches of regex in tweet
positive_matches = re.____(____, ____)
# Complete format to print out the results
print("Positive comments found ____".format(____))