CommencezCommencez gratuitement

Combiner groupby() et resample()

Une méthode très puissante dans Pandas est .groupby(). Alors que .resample() regroupe les lignes selon des renseignements de temps ou de date, .groupby() regroupe les lignes selon les valeurs d'une ou de plusieurs colonnes. Par exemple, rides.groupby('Member type').size() nous indiquerait combien de trajets il y a eu par type de membre dans l'ensemble de notre DataFrame.

On peut appeler .resample() après .groupby(). Par exemple, quelle a été la durée médiane des trajets par mois et par type d'abonnement?

Cette activité fait partie du cours

Travailler avec les dates et les heures en Python

Voir le cours

Instructions de l’exercice

  • Complétez l'appel à .groupby() pour regrouper par 'Member type', puis l'appel à .resample() pour rééchantillonner selon 'Start date', par mois.
  • Affichez la médiane de Duration pour chaque groupe.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Group rides by member type, and resample to the month
grouped = rides.groupby('____')\
  .resample('____', on = '____')

# Print the median duration for each group
print(grouped[____].____)
Modifier et exécuter le code