Aan de slagBegin gratis

Steekproefstatistieken versus populatie

In deze oefening werk je met een vooraf geladen population. Je stelt een sample samen door willekeurig punten uit de populatie te trekken. Je berekent het gemiddelde en de standaarddeviatie van de steekproef uit die populatie om te testen of de steekproef representatief is voor de populatie. Je doel is te zien of de steekproefstatistieken gelijk zijn aan of heel dicht bij de populatiestatistieken liggen.

Deze oefening maakt deel uit van de cursus

Introductie tot lineaire modellering in Python

Bekijk cursus

Oefeninstructies

  • Bereken en print het gemiddelde en de standaarddeviatie van de population-gegevens.
  • Gebruik de methode np.random.seed() om de seed van de pseudorandom-sampler van numpy op 42 te zetten.
  • Gebruik np.random.choice() om een sample te maken met size=31, waarbij size het aantal getrokken punten uit de population is.
  • Bereken en print het gemiddelde en de standaarddeviatie van de sample en bekijk de geprinte waarden van de steekproef- en populatiestatistieken om te zien of ze verschillen.

Interactieve oefening met praktijkervaring

Probeer deze oefening door deze voorbeeldcode aan te vullen.

# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))

# Set random seed for reproducibility
____.____.____(42)

# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)

# Compare sample statistics to the population statistics
print("    Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))
Code bewerken en uitvoeren