Enkel sampling med pandas
I det här kapitlet utforskar du låtdata från Spotify. Varje rad i den här populationsdatamängden representerar en låt, och det finns över 40 000 rader. Kolumnerna innehåller låtnamn, artister, utgivningsår och egenskaper som längd, tempo och dansvänlighet. Du börjar med att titta på låtlängderna.
Din första uppgift är att ta ett urval från Spotify-datamängden och jämföra den genomsnittliga längden i populationen med den i urvalet.
spotify_population finns tillgänglig och pandas är inläst som pd.
Den här övningen är en del av kursen
Sampling i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Sample 1000 rows from spotify_population
spotify_sample = ____
# Print the sample
print(spotify_sample)