Reviews normaliseren
Tijd om belangrijke woorden uit je gegevensset met filmreviews te halen. Eerst normaliseer je ze en daarna tel je hun frequentie. Bij het normaliseren zet je alle woorden om naar kleine letters, verwijder je speciale tekens en haal je de stam van een woord zodat je varianten als één telt.
Stel, je hebt de volgende reviews: The movie surprises me very much en Marvel movies always surprise their audience. Als je de woordfrequentie telt, tel je surprises één keer en surprise één keer. Maar het werkwoord surprise komt in beide voor en de frequentie zou dus twee moeten zijn.
De tekst van één filmreview is alvast opgeslagen in de variabele movie. Je kunt print(movie) gebruiken om de variabele in de IPython Shell te bekijken.
Deze oefening maakt deel uit van de cursus
Regular expressions in Python
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Convert to lowercase and print the result
movie_lower = ____
print(____)