Statistiques d'échantillon versus population
Dans cet exercice, vous travaillerez avec une population déjà chargée. Vous construirez un sample en tirant au hasard des points de cette population. Vous calculerez la moyenne et l'écart type de l'échantillon tiré de cette population pour vérifier si l'échantillon est représentatif de la population. Votre objectif est de voir si les statistiques de l'échantillon sont identiques ou très proches de celles de la population.

Cette activité fait partie du cours
Introduction aux modèles linéaires en Python
Instructions de l’exercice
- Calculez et affichez la moyenne et l'écart type des données
population. - Utilisez la méthode
np.random.seed()pour définir la graine du générateur pseudo-aléatoire denumpyà42. - Utilisez
np.random.choice()pour créer unsampleavecsize=31, où size correspond au nombre de points tirés de lapopulation. - Calculez et affichez la moyenne et l'écart type du
sample, puis examinez les valeurs affichées des statistiques de l'échantillon et de la population pour voir si elles diffèrent.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))
# Set random seed for reproducibility
____.____.____(42)
# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)
# Compare sample statistics to the population statistics
print(" Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))