Průměr průměrů
Chceš zjistit, jaký je průměrný počet uživatelů (num_users) na jeden obchod – a to za celou firmu, abys mohl/a porovnat, jestli Amirovy obchody mají více nebo méně uživatelů než firemní průměr. Problém je, že za poslední rok firma uzavřela více než deset tisíc obchodů, takže shromáždit všechna data není reálné. Místo toho průměr odhadneš pomocí několika náhodných vzorků obchodů – to je mnohem jednodušší než sbírat data od celé firmy.
K dispozici máš amir_deals a uživatelská data pro všechny firemní obchody jsou v all_deals. Načteny jsou také pandas jako pd a numpy jako np.
Toto cvičení je součástí kurzu
Úvod do statistiky v Pythonu
Pokyny k cvičení
- Nastav náhodný seed na
321. - Vezmi 30 vzorků (s vracením) o velikosti 20 ze sloupce
all_deals['num_users']a vypočítej průměr každého vzorku. Průměry vzorků ulož dosample_means. - Vypiš průměr hodnot v
sample_means. - Vypiš průměr sloupce
num_userszamir_deals.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Set seed to 321
____
sample_means = []
# Loop 30 times to take 30 means
for i in range(____):
# Take sample of size 20 from num_users col of all_deals with replacement
cur_sample = ____
# Take mean of cur_sample
cur_mean = ____
# Append cur_mean to sample_means
sample_means.append(____)
# Print mean of sample_means
print(____)
# Print mean of num_users in amir_deals
print(____)