Gộp thuộc tính dữ liệu
Mặc định, merge() sẽ gộp dựa trên các cột trùng tên ở cả hai tập dữ liệu. Trong trường hợp này thì không phù hợp, vì cột ID có tên là tract trong một tập và TRACTCE trong tập còn lại. Để xử lý, merge() có các tham số tùy chọn by.x và by.y, nơi bạn chỉ định tên cột dùng để gộp ở hai tập dữ liệu tương ứng.
merge() trả về một đối tượng Spatial___DataFrame mới, nên bạn có thể xem kết quả bằng cách vẽ với tmap.
Hãy tiến hành gộp dữ liệu.
Bài tập này là một phần của khóa học
Trực quan hóa dữ liệu địa lý trong R
Hướng dẫn bài tập
- Dùng
merge(), truyền đối tượng không giannyc_tractstrước và data framenyc_incomesau. Chỉ địnhby.x = "TRACTCE"vàby.y = "tract". Lưu kết quả vàonyc_tracts_merge. - Dùng
summary()trênnyc_tracts_mergeđể xác nhận đối tượng làSpatialPolygonsDataFramevà dữ liệu cũng chứa cộtestimatecần thiết từnyc_income. - Dùng
tm_shape()và thêm một lớptm_fill()để tạo bản đồ choropleth củanyc_tracts_merge, ánh xạ màu theoestimate.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
library(sp)
library(tmap)
# Merge nyc_tracts and nyc_income: nyc_tracts_merge
# Call summary() on nyc_tracts_merge
# Choropleth with col mapped to estimate