검색 오타와 가장 가까운 일치 항목 찾기
사람이 입력하는 값에는 오류가 자주 발생해요. 이름이나 주소처럼 온갖 텍스트에서 오타가 생길 수 있고, 데이터 과학자인 여러분은 이를 처리할 방법을 찾아야 해요. 문자열 거리를 계산하는 것은 이 문제를 해결하는 한 가지 방법이에요.
작은 벡터 usernames에는 서로 다른 이름이 세 개 들어 있어요. 입력된 이름 "Emile Brown"에 가장 가까운 이름을 찾아보세요. 벡터 usernames에서 비슷한 이름을 찾기 위해 amatch()를 사용하고, Google에서 보셨던 것과 비슷한 추천 문구를 출력해 보세요.
이 연습은 강의의 일부입니다
R 중급 정규 표현식
연습 안내
amatch()함수의 최대 편집 거리를1로 지정하세요.closest_index에 저장된amatch()의 반환 값을 이용해usernames의 이름을 출력하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
usernames <- c("Max Power", "Emilie Brown", "Max Mustermann")
# Search usernames with a maximum edit distance of 1
closest_index <- amatch(
x = "Emile Brown",
table = usernames,
___ = ___,
method = "lv"
)
# Print the matched name in usernames at closest_index
print(glue(
"Did you mean {name_matched}?",
name_matched = ___
))