Beliebtheit von Genres zählen
Um die häufigsten Genres im gesamten Katalog zu finden, forme die genres-Listenspalte so um, dass jedes Genre in einer eigenen Zeile steht, und berechne anschließend eine sortierte Häufigkeitsverteilung, um zu sehen, welche Genres die Liste anführen.
Das DataFrame movies ist bereits für dich geladen.
Diese Übung ist Teil des Kurses
<Kurs>Skalieren und Optimieren von Data-Pipelines mit Polars</Kurs>Übungsanweisungen
- Explodiere die
genres-Listenspalte, sodass jedes Genre eine eigene Zeile erhält. - Ermittle die 10 häufigsten Genres mit einer sortierten Häufigkeitsverteilung.
Interaktive praktische Übung
Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.
# Put each genre on its own row
genres = movies.select("genres").____("genres")["genres"]
# Rank by frequency
result = genres.drop_nulls().____(sort=True).head(10)
print(result)