เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การวิเคราะห์ด้วย Cluster Sampling

คุณและกลุ่มนักจิตวิทยากำลังศึกษาสุขภาพจิตของพนักงาน งานวิจัยนี้ใช้แบบสำรวจเพื่อวัดทัศนคติต่อสุขภาพจิตในที่ทำงานด้านเทคโนโลยี และตรวจสอบความถี่ของภาวะสุขภาพจิตในหมู่พนักงานสายเทค

ชุดข้อมูล mh_survey ประกอบด้วย gender (เพศของผู้ตอบแบบสำรวจ), US_state_live (รัฐที่อาศัยอยู่ในสหรัฐอเมริกา) และ sought_treatment (บอกว่าเคยขอรับการรักษาด้านสุขภาพจิตผ่านนายจ้างหรือไม่)

ในแบบฝึกหัดนี้ จะสร้างแผนภูมิวงกลมเพื่อวิเคราะห์แนวโน้มที่พนักงานสายเทคในสหรัฐฯ จะขอรับการรักษาด้านสุขภาพจิต (sought_treatment) รายการสุ่ม 10 กลุ่มรัฐ random_cluster ได้ถูกโหลดไว้ให้แล้ว

Pandas และ numpy ถูกโหลดไว้แล้วในชื่อ pd และ np

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การวิเคราะห์ข้อมูลแบบสำรวจด้วย Python

ดูคอร์ส

คำแนะนำการฝึกหัด

  • กรองชุดข้อมูลให้เหลือเฉพาะรัฐที่อยู่ใน random_clusters
  • สร้างแผนภูมิวงกลมของคอลัมน์ sought_treatment

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]

# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()
แก้ไขและรันโค้ด