Začněte nyníZačněte zdarma

Spojení datových rámců

V předchozím cvičení jsi sestavil/a dataset 100 nejlépe hodnocených kaváren v New Yorku podle Yelpu. Teď ho zkombinuješ s demografickými daty, abys zjistil/a, která čtvrť má nejvíce dobrých kaváren na počet obyvatel.

K tomu použiješ metodu merge() pro spojení dvou datových rámců. První z nich, crosswalk, je převodník mezi PSČ a oblastmi PUMA (Public Use Micro Data Sample Areas) – agregáty sčítacích obvodů přibližně odpovídající newyorským čtvrtím. Poté přidáš data pop_data s odhadem počtu obyvatel pro každou oblast PUMA za rok 2016.

pandas (jako pd) je již importován, stejně jako datový rámec cafes z předchozího cvičení.

Toto cvičení je součástí kurzu

Streamlined Data Ingestion with pandas

Zobrazit kurz

Interaktivní praktické cvičení

Proměňte teorii v praxi s jedním z našich interaktivních cvičení

Začít cvičení