Statistiky vzorku vs. statistiky populace
V tomto cvičení budeš pracovat s předem načtenou proměnnou population. Sestavíš sample (vzorek) náhodným výběrem bodů z populace a spočítáš průměr a směrodatnou odchylku tohoto vzorku, abys ověřil/a, zda vzorek reprezentuje celou populaci. Cílem je zjistit, zda jsou statistiky vzorku shodné nebo velmi blízké statistikám populace.

Toto cvičení je součástí kurzu
Úvod do lineárního modelování v Pythonu
Pokyny k cvičení
- Vypočítej a vypiš průměr a směrodatnou odchylku dat v
population. - Pomocí metody
np.random.seed()nastav seed pseudonáhodného generátorunumpyna hodnotu42. - Pomocí
np.random.choice()vytvořsampleo velikostisize=31, kde velikost udává počet bodů vybraných zpopulation. - Vypočítej a vypiš průměr a směrodatnou odchylku
samplea porovnej výsledné hodnoty se statistikami populace — všimni si, zda se od sebe liší.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))
# Set random seed for reproducibility
____.____.____(42)
# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)
# Compare sample statistics to the population statistics
print(" Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))