เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

ประสิทธิภาพด้านเวลาของ k-means clustering

จำได้ไหมว่า hierarchical clustering ใช้เวลานานมากในการรัน แล้ว kmeans() บนชุดข้อมูล FIFA จะใช้เวลานานแค่ไหน?

ข้อมูลถูกเก็บไว้ใน pandas DataFrame ชื่อ fifa โดย scaled_sliding_tackle และ scaled_aggression คือคอลัมน์ที่ผ่านการสเกลแล้วที่ต้องใช้ ทั้ง timeit และ kmeans ได้ถูก import ไว้แล้ว

เซนทรอยด์ของคลัสเตอร์กำหนดผ่านฟังก์ชัน kmeans() ซึ่งต้องการอาร์กิวเมนต์สองตัวได้แก่ ข้อมูลการสังเกตและจำนวนคลัสเตอร์ สามารถใช้ %timeit นำหน้าโค้ดเพื่อตรวจสอบระยะเวลาการรัน ลองจับเวลาฟังก์ชัน kmeans() สำหรับสามคลัสเตอร์บนชุดข้อมูล fifa ได้เลย

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การวิเคราะห์กลุ่มข้อมูลใน Python

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง

เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา

เริ่มแบบฝึกหัด