Začněte nyníZačněte zdarma

Statistiky vzorku vs. statistiky populace

V tomto cvičení budeš pracovat s předem načtenou proměnnou population. Sestavíš sample (vzorek) náhodným výběrem bodů z populace a spočítáš průměr a směrodatnou odchylku tohoto vzorku, abys ověřil/a, zda vzorek reprezentuje celou populaci. Cílem je zjistit, zda jsou statistiky vzorku shodné nebo velmi blízké statistikám populace.

Toto cvičení je součástí kurzu

Úvod do lineárního modelování v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Vypočítej a vypiš průměr a směrodatnou odchylku dat v population.
  • Pomocí metody np.random.seed() nastav seed pseudonáhodného generátoru numpy na hodnotu 42.
  • Pomocí np.random.choice() vytvoř sample o velikosti size=31, kde velikost udává počet bodů vybraných z population.
  • Vypočítej a vypiš průměr a směrodatnou odchylku sample a porovnej výsledné hodnoty se statistikami populace — všimni si, zda se od sebe liší.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))

# Set random seed for reproducibility
____.____.____(42)

# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)

# Compare sample statistics to the population statistics
print("    Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))
Upravit a spustit kód