Medelvärdet av medelvärden
Du vill veta det genomsnittliga antalet användare (num_users) per affär, men du vill ha det här talet för hela företaget så att du kan se om Amirs affärer har fler eller färre användare än företagets genomsnittliga affär. Problemet är att företaget under det senaste året har arbetat med fler än tiotusen affärer, vilket gör det orealistiskt att samla in all data. Istället ska du uppskatta medelvärdet genom att ta flera slumpmässiga urval av affärer, eftersom det är mycket enklare än att samla in data från hela företaget.
amir_deals finns tillgänglig och användardata för alla företagets affärer finns i all_deals. Både pandas som pd och numpy som np är inlästa.
Den här övningen är en del av kursen
Introduktion till statistik i Python
Övningsinstruktioner
- Sätt det slumpmässiga fröet till
321. - Ta 30 urval (med återläggning) av storlek 20 från
all_deals['num_users']och beräkna medelvärdet för varje urval. Lagra urvalsmedelvärden isample_means. - Skriv ut medelvärdet av
sample_means. - Skriv ut medelvärdet för kolumnen
num_usersiamir_deals.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Set seed to 321
____
sample_means = []
# Loop 30 times to take 30 means
for i in range(____):
# Take sample of size 20 from num_users col of all_deals with replacement
cur_sample = ____
# Take mean of cur_sample
cur_mean = ____
# Append cur_mean to sample_means
sample_means.append(____)
# Print mean of sample_means
print(____)
# Print mean of num_users in amir_deals
print(____)