Začněte nyníZačněte zdarma

Průměr průměrů

Chceš zjistit, jaký je průměrný počet uživatelů (num_users) na jeden obchod – a to za celou firmu, abys mohl/a porovnat, jestli Amirovy obchody mají více nebo méně uživatelů než firemní průměr. Problém je, že za poslední rok firma uzavřela více než deset tisíc obchodů, takže shromáždit všechna data není reálné. Místo toho průměr odhadneš pomocí několika náhodných vzorků obchodů – to je mnohem jednodušší než sbírat data od celé firmy.

K dispozici máš amir_deals a uživatelská data pro všechny firemní obchody jsou v all_deals. Načteny jsou také pandas jako pd a numpy jako np.

Toto cvičení je součástí kurzu

Úvod do statistiky v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Nastav náhodný seed na 321.
  • Vezmi 30 vzorků (s vracením) o velikosti 20 ze sloupce all_deals['num_users'] a vypočítej průměr každého vzorku. Průměry vzorků ulož do sample_means.
  • Vypiš průměr hodnot v sample_means.
  • Vypiš průměr sloupce num_users z amir_deals.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Set seed to 321
____

sample_means = []
# Loop 30 times to take 30 means
for i in range(____):
  # Take sample of size 20 from num_users col of all_deals with replacement
  cur_sample = ____
  # Take mean of cur_sample
  cur_mean = ____
  # Append cur_mean to sample_means
  sample_means.append(____)

# Print mean of sample_means
print(____)

# Print mean of num_users in amir_deals
print(____)
Upravit a spustit kód