Samplingfördelning vs. bootstrapfördelning
Samplingfördelningen och bootstrapfördelningen hänger nära samman. I de sällsynta fall där du kan ta upprepade urval från en population är det värdefullt att generera båda fördelningarna efter varandra för att se hur de förhåller sig till varandra.
Här är statistiken du undersöker medelvärdet av popularity-poängen för låtarna.
spotify_population (hela datamängden) och spotify_sample (500 slumpmässigt urvalda rader från spotify_population) är tillgängliga; pandas och numpy är inlästa med sina vanliga alias.
Den här övningen är en del av kursen
Sampling i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
mean_popularity_2000_samp = []
# Generate a sampling distribution of 2000 replicates
____:
mean_popularity_2000_samp.append(
# Sample 500 rows and calculate the mean popularity
____
)
# Print the sampling distribution results
print(mean_popularity_2000_samp)