Steekproefstatistieken versus populatie
In deze oefening werk je met een vooraf geladen population. Je stelt een sample samen door willekeurig punten uit de populatie te trekken. Je berekent het gemiddelde en de standaarddeviatie van de steekproef uit die populatie om te testen of de steekproef representatief is voor de populatie. Je doel is te zien of de steekproefstatistieken gelijk zijn aan of heel dicht bij de populatiestatistieken liggen.

Deze oefening maakt deel uit van de cursus
Introductie tot lineaire modellering in Python
Oefeninstructies
- Bereken en print het gemiddelde en de standaarddeviatie van de
population-gegevens. - Gebruik de methode
np.random.seed()om de seed van de pseudorandom-sampler vannumpyop42te zetten. - Gebruik
np.random.choice()om eensamplete maken metsize=31, waarbij size het aantal getrokken punten uit depopulationis. - Bereken en print het gemiddelde en de standaarddeviatie van de
sampleen bekijk de geprinte waarden van de steekproef- en populatiestatistieken om te zien of ze verschillen.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))
# Set random seed for reproducibility
____.____.____(42)
# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)
# Compare sample statistics to the population statistics
print(" Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))