Podobne restauracje
W poprzednim ćwiczeniu wygenerowałeś pary między restaurants a restaurants_new, aby móc czysto połączyć oba zbiory danych za pomocą łączenia rekordów.
Podczas łączenia rekordów możesz stosować różne typy dopasowań między kolumnami zbiorów danych – w tym dokładne dopasowania, podobieństwo ciągów znaków i inne.
Teraz, gdy pary zostały wygenerowane i zapisane w pairs, znajdziesz dokładne dopasowania w kolumnach city i cuisine_type dla każdej pary oraz podobne ciągi znaków w kolumnie rest_name. W środowisku dostępne są oba zbiory danych, pandas oraz recordlinkage.
To ćwiczenie jest częścią kursu
Czyszczenie danych w Pythonie
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create a comparison object
comp_cl = ____