ÎncepețiÎncepe gratuit

Verificarea compatibilității datelor

Forțarea datelor în slotul data nu funcționează, deoarece se pierde corespondența corectă dintre rânduri și obiectele spațiale. Cum adaugi atunci datele despre venituri la datele poligonale? Funcția merge() din sp este concepută exact în acest scop.

Poate ai mai folosit merge() cu cadre de date. sp::merge() are aproape aceeași structură, dar îi pasezi un obiect Spatial*** și un cadru de date, iar rezultatul este un nou obiect Spatial*** în care slotul de date reprezintă interclasarea slotului original cu cadrul de date. Pentru a realiza această interclasare, atât obiectul spațial, cât și cadrul de date trebuie să aibă o coloană cu ID-uri de potrivire.

Atât nyc_tracts, cât și nyc_income au coloane cu ID-uri de tract, deci sunt candidați ideali pentru a interclasa cele două seturi de date. Este întotdeauna o idee bună să verifici că ID-urile propuse sunt unice și că există o corespondență pentru fiecare rând din ambele seturi de date.

Hai să facem această verificare înainte de a trece la interclasare.

Acest exercițiu face parte din cursul

Vizualizarea datelor geospațiale în R

Vezi cursul

Instrucțiuni pentru exercițiu

  • Folosește any() împreună cu duplicated() pe nyc_income$tract pentru a verifica dacă fiecare rând din nyc_income are un ID de tract unic.
  • Folosește any() împreună cu duplicated() pe nyc_tracts$TRACTCE pentru a verifica dacă fiecare rând din nyc_tracts are un ID de tract unic.
  • Folosește all() pe nyc_tracts$TRACTCE %in% nyc_income$tract pentru a verifica că toate tracturile din nyc_tracts se regăsesc în nyc_income.
  • Folosește all() pe nyc_income$tract %in% nyc_tracts$TRACTCE pentru a verifica că toate tracturile din nyc_income se regăsesc în nyc_tracts.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Check for duplicates in nyc_income


# Check for duplicates in nyc_tracts


# Check nyc_tracts in nyc_income


# Check nyc_income in nyc_tracts
Editează și rulează codul