การวิเคราะห์ด้วย Cluster Sampling
คุณและกลุ่มนักจิตวิทยากำลังศึกษาสุขภาพจิตของพนักงาน งานวิจัยนี้ใช้แบบสำรวจเพื่อวัดทัศนคติต่อสุขภาพจิตในที่ทำงานด้านเทคโนโลยี และตรวจสอบความถี่ของภาวะสุขภาพจิตในหมู่พนักงานสายเทค
ชุดข้อมูล mh_survey ประกอบด้วย gender (เพศของผู้ตอบแบบสำรวจ), US_state_live (รัฐที่อาศัยอยู่ในสหรัฐอเมริกา) และ sought_treatment (บอกว่าเคยขอรับการรักษาด้านสุขภาพจิตผ่านนายจ้างหรือไม่)
ในแบบฝึกหัดนี้ จะสร้างแผนภูมิวงกลมเพื่อวิเคราะห์แนวโน้มที่พนักงานสายเทคในสหรัฐฯ จะขอรับการรักษาด้านสุขภาพจิต (sought_treatment)
รายการสุ่ม 10 กลุ่มรัฐ random_cluster ได้ถูกโหลดไว้ให้แล้ว
Pandas และ numpy ถูกโหลดไว้แล้วในชื่อ pd และ np
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การวิเคราะห์ข้อมูลแบบสำรวจด้วย Python
คำแนะนำการฝึกหัด
- กรองชุดข้อมูลให้เหลือเฉพาะรัฐที่อยู่ใน
random_clusters - สร้างแผนภูมิวงกลมของคอลัมน์
sought_treatment
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]
# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()