모두 합쳐 보기
이번 장에서는 문자열 유사도를 이용해 zagat의 city 열을 정리했고, zagat과 fodors에서 레스토랑 쌍을 생성하여 비교해 보았어요. 이제 거의 끝났습니다. 남은 일은 쌍을 점수화하고 선택한 뒤 데이터를 연결(link)하는 것뿐이에요. 그러면 곧바로 분석을 시작할 수 있습니다!
reclin과 dplyr는 로드되어 있고 zagat과 fodors를 사용할 수 있어요.
이 연습은 강의의 일부입니다
R로 데이터 정리하기
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Create pairs
pair_blocking(zagat, fodors, blocking_var = "city") %>%
# Compare pairs
compare_pairs(by = c("name", "addr"), default_comparator = jaro_winkler()) %>%
# Score pairs
___