CommencezCommencez gratuitement

Statistiques d'échantillon versus population

Dans cet exercice, vous travaillerez avec une population déjà chargée. Vous construirez un sample en tirant au hasard des points de cette population. Vous calculerez la moyenne et l'écart type de l'échantillon tiré de cette population pour vérifier si l'échantillon est représentatif de la population. Votre objectif est de voir si les statistiques de l'échantillon sont identiques ou très proches de celles de la population.

Cette activité fait partie du cours

Introduction aux modèles linéaires en Python

Voir le cours

Instructions de l’exercice

  • Calculez et affichez la moyenne et l'écart type des données population.
  • Utilisez la méthode np.random.seed() pour définir la graine du générateur pseudo-aléatoire de numpy à 42.
  • Utilisez np.random.choice() pour créer un sample avec size=31, où size correspond au nombre de points tirés de la population.
  • Calculez et affichez la moyenne et l'écart type du sample, puis examinez les valeurs affichées des statistiques de l'échantillon et de la population pour voir si elles diffèrent.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))

# Set random seed for reproducibility
____.____.____(42)

# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)

# Compare sample statistics to the population statistics
print("    Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))
Modifier et exécuter le code