CommencezCommencez gratuitement

Vérifier la correspondance des données

Forcer vos données dans l'emplacement data ne fonctionne pas, car vous perdez la bonne correspondance entre les lignes et les objets spatiaux. Comment ajouter les données de revenu aux données de polygones? La fonction merge() du paquet sp est conçue précisément pour cela.

Vous avez peut‑être déjà vu merge() avec des trames de données. sp::merge() a pratiquement la même structure, mais vous lui passez un objet Spatial*** et une trame de données, et elle retourne un nouvel objet Spatial*** dont l'emplacement des données est maintenant la fusion de l'emplacement d'origine et de la trame de données. Pour effectuer cette fusion, l'objet spatial et la trame de données doivent tous deux avoir une colonne contenant des identifiants sur lesquels faire l'appariement.

nyc_tracts et nyc_income ont tous deux des colonnes avec des identifiants de secteur de recensement; ce sont donc d'excellents candidats pour fusionner les deux jeux de données. Toutefois, il est toujours judicieux de vérifier que les identifiants proposés sont uniques et qu'il existe une correspondance pour chaque ligne dans les deux jeux de données.

Vérifions cela avant de passer à la fusion.

Cette activité fait partie du cours

Visualiser des données géospatiales avec R

Voir le cours

Instructions de l’exercice

  • Utilisez any() avec duplicated() sur nyc_income$tract pour vérifier que chaque ligne de nyc_income possède un identifiant de secteur unique.
  • Utilisez any() avec duplicated() sur nyc_tracts$TRACTCE pour vérifier que chaque ligne de nyc_tracts possède un identifiant de secteur unique.
  • Utilisez all() sur nyc_tracts$TRACTCE %in% nyc_income$tract pour vérifier que les secteurs de nyc_tracts se trouvent tous dans nyc_income.
  • Utilisez all() sur nyc_income$tract %in% nyc_tracts$TRACTCE pour vérifier que les secteurs de nyc_income se trouvent tous dans nyc_tracts.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Check for duplicates in nyc_income


# Check for duplicates in nyc_tracts


# Check nyc_tracts in nyc_income


# Check nyc_income in nyc_tracts
Modifier et exécuter le code