Zacznij terazZacznij za darmo

Podobne restauracje

W poprzednim ćwiczeniu wygenerowałeś pary między restaurants a restaurants_new, aby móc czysto połączyć oba zbiory danych za pomocą łączenia rekordów.

Podczas łączenia rekordów możesz stosować różne typy dopasowań między kolumnami zbiorów danych – w tym dokładne dopasowania, podobieństwo ciągów znaków i inne.

Teraz, gdy pary zostały wygenerowane i zapisane w pairs, znajdziesz dokładne dopasowania w kolumnach city i cuisine_type dla każdej pary oraz podobne ciągi znaków w kolumnie rest_name. W środowisku dostępne są oba zbiory danych, pandas oraz recordlinkage.

To ćwiczenie jest częścią kursu

Czyszczenie danych w Pythonie

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Create a comparison object
comp_cl = ____
Edytuj i uruchom kod