เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การแมปหมวดหมู่ใหม่ II

ในแบบฝึกหัดที่แล้ว คุณได้กำหนดแล้วว่าค่า cutoff ของระยะห่างสำหรับการแมปคำที่สะกดผิดของประเภทอาหาร 'american', 'asian' และ 'italian' ในคอลัมน์ cuisine_type ควรอยู่ที่ 80

ในแบบฝึกหัดนี้ คุณจะนำทุกอย่างมารวมกัน โดยหาคู่ที่มีคะแนนความคล้ายกันเท่ากับหรือสูงกว่า 80 ด้วยฟังก์ชัน extract() ของ fuzywuzzy.process สำหรับประเภทอาหารที่ถูกต้องแต่ละประเภท แล้วแทนที่คู่ที่พบด้วยค่าที่ถูกต้อง โปรดจำไว้ว่า เมื่อใช้ process.extract() เปรียบเทียบสตริงกับอาร์เรย์ของสตริง ผลลัพธ์ที่ได้จะเป็นลิสต์ของทูเพิล โดยแต่ละทูเพิลมีรูปแบบดังนี้:

(closest match, similarity score, index of match)

DataFrame restaurants พร้อมใช้งานในสภาพแวดล้อมของคุณแล้ว และคุณมีสิทธิ์เข้าถึงลิสต์ categories ที่บรรจุประเภทอาหารที่ถูกต้อง ('italian', 'asian' และ 'american')

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การทำความสะอาดข้อมูลใน Python

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Inspect the unique values of the cuisine_type column
print(____)
แก้ไขและรันโค้ด