Mappa om kategorier II
I förra övningen kom du fram till att gränsvärdet för likhet vid ommappning av stavfel i kökstypen 'american', 'asian' och 'italian' i kolumnen cuisine_type bör vara 80.
I den här övningen sätter du ihop allt: du hittar träffar med likhetspoäng på 80 eller högre med hjälp av funktionen extract() från fuzywuzzy.process, för varje korrekt kökstyp, och ersätter dessa träffar med rätt värde. Kom ihåg att när du jämför en sträng med en array av strängar via process.extract() är utdatan en lista med tupler, där varje tupel är formaterad så här:
(närmaste träff, likhetspoäng, träffens index)
DataFrame:n restaurants finns i din miljö, och du har tillgång till en lista categories som innehåller de korrekta kökstyperna ('italian', 'asian' och 'american').
Den här övningen är en del av kursen
Datarensning i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Inspect the unique values of the cuisine_type column
print(____)