Začněte nyníZačněte zdarma

Přemapování kategorií II

V předchozím cvičení jsi zjistil/a, že hranice vzdálenosti pro přemapování překlepů typů kuchyně 'american', 'asian' a 'italian' uložených ve sloupci cuisine_type by měla být 80.

V tomto cvičení to celé spojíš dohromady: pomocí funkce extract() z fuzywuzzy.process najdeš shody se skóre podobnosti 80 a vyšším pro každý správný typ kuchyně a tyto shody jím nahradíš. Nezapomeň, že při porovnávání řetězce s polem řetězců pomocí process.extract() je výstupem seznam n-tic, kde každá má formát:

(nejbližší shoda, skóre podobnosti, index shody)

DataFrame restaurants je dostupný ve tvém prostředí a máš přístup k seznamu categories obsahujícímu správné typy kuchyně ('italian', 'asian' a 'american').

Toto cvičení je součástí kurzu

Čištění dat v Pythonu

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Inspect the unique values of the cuisine_type column
print(____)
Upravit a spustit kód