Găsirea unei potriviri pentru o eroare de tastare
Introducerea manuală a datelor este predispusă la erori. Oamenii scriu greșit tot felul de texte, inclusiv propriul nume sau adresă, iar tu, ca om de știința datelor, trebuie să găsești o modalitate de a gestiona această problemă. Calcularea distanțelor dintre șiruri de caractere este una dintre soluții.
În vectorul usernames vei găsi trei nume diferite. Sarcina ta este să găsești cel mai apropiat nume de cel introdus: "Emile Brown". Există un nume similar în vectorul usernames? Folosește amatch() pentru a căuta în vector și afișează o recomandare similară cu cea pe care ai văzut-o pe Google.
Acest exercițiu face parte din cursul
Expresii regulate intermediare în R
Instrucțiuni pentru exercițiu
- Specifică distanța maximă de editare pentru funcția
amatch()ca fiind1. - Folosește valoarea returnată de
amatch(), stocată înclosest_index, pentru a afișa numele corespunzător dinusernames.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
usernames <- c("Max Power", "Emilie Brown", "Max Mustermann")
# Search usernames with a maximum edit distance of 1
closest_index <- amatch(
x = "Emile Brown",
table = usernames,
___ = ___,
method = "lv"
)
# Print the matched name in usernames at closest_index
print(glue(
"Did you mean {name_matched}?",
name_matched = ___
))