ประสิทธิภาพด้านเวลาของ k-means clustering
จำได้ไหมว่า hierarchical clustering ใช้เวลานานมากในการรัน แล้ว kmeans() บนชุดข้อมูล FIFA จะใช้เวลานานแค่ไหน?
ข้อมูลถูกเก็บไว้ใน pandas DataFrame ชื่อ fifa โดย scaled_sliding_tackle และ scaled_aggression คือคอลัมน์ที่ผ่านการสเกลแล้วที่ต้องใช้ ทั้ง timeit และ kmeans ได้ถูก import ไว้แล้ว
เซนทรอยด์ของคลัสเตอร์กำหนดผ่านฟังก์ชัน kmeans() ซึ่งต้องการอาร์กิวเมนต์สองตัวได้แก่ ข้อมูลการสังเกตและจำนวนคลัสเตอร์ สามารถใช้ %timeit นำหน้าโค้ดเพื่อตรวจสอบระยะเวลาการรัน ลองจับเวลาฟังก์ชัน kmeans() สำหรับสามคลัสเตอร์บนชุดข้อมูล fifa ได้เลย
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การวิเคราะห์กลุ่มข้อมูลใน Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด