Přemapování kategorií II
V předchozím cvičení jsi zjistil/a, že hranice vzdálenosti pro přemapování překlepů typů kuchyně 'american', 'asian' a 'italian' uložených ve sloupci cuisine_type by měla být 80.
V tomto cvičení to celé spojíš dohromady: pomocí funkce extract() z fuzywuzzy.process najdeš shody se skóre podobnosti 80 a vyšším pro každý správný typ kuchyně a tyto shody jím nahradíš. Nezapomeň, že při porovnávání řetězce s polem řetězců pomocí process.extract() je výstupem seznam n-tic, kde každá má formát:
(nejbližší shoda, skóre podobnosti, index shody)
DataFrame restaurants je dostupný ve tvém prostředí a máš přístup k seznamu categories obsahujícímu správné typy kuchyně ('italian', 'asian' a 'american').
Toto cvičení je součástí kurzu
Čištění dat v Pythonu
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Inspect the unique values of the cuisine_type column
print(____)