CommencezCommencez gratuitement

Fusionner des dataframes

Dans le dernier exercice, vous avez construit un jeu de données des 100 meilleurs cafés de New York selon Yelp. Maintenant, vous allez y combiner des données démographiques pour déterminer quel quartier compte le plus de bons cafés par habitant.

Pour ce faire, vous allez fusionner deux jeux de données avec la méthode merge() des DataFrame. Le premier, crosswalk, est une table de correspondance entre les codes ZIP et les zones PUMA (Public Use Microdata Areas), qui sont des regroupements de secteurs de recensement et correspondent à peu près aux quartiers de NYC. Ensuite, vous ajouterez pop_data, qui contient les estimations de population de 2016 pour chaque PUMA.

pandas (sous pd) a été importé, tout comme le dataframe cafes de l'exercice précédent.

Cette activité fait partie du cours

Ingestion de données rationalisée avec pandas

Voir le cours

Exercice interactif pratique

Passez de la théorie à l’action grâce à l’un de nos exercices interactifs

Commencer l’exercice