สถิติของ Sample เทียบกับ Population
ในแบบฝึกหัดนี้ จะได้ทำงานกับ population ที่โหลดไว้ให้แล้ว โดยจะสร้าง sample ขึ้นมาจากการสุ่มเลือกจุดข้อมูลจาก population จากนั้นคำนวณค่าเฉลี่ยและส่วนเบี่ยงเบนมาตรฐานของ sample เพื่อตรวจสอบว่า sample นั้นเป็นตัวแทนของ population ได้ดีเพียงใด เป้าหมายคือดูว่าสถิติของ sample ใกล้เคียงหรือเท่ากับสถิติของ population หรือไม่

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Introduction to Linear Modeling in Python
คำแนะนำการฝึกหัด
- คำนวณและแสดงค่าเฉลี่ยและส่วนเบี่ยงเบนมาตรฐานของข้อมูล
population - ใช้เมธอด
np.random.seed()เพื่อกำหนด seed ของตัวสุ่มเลขของnumpyเป็น42 - ใช้
np.random.choice()เพื่อสร้างsampleที่มีsize=31โดย size คือจำนวนจุดข้อมูลที่สุ่มจากpopulation - คำนวณและแสดงค่าเฉลี่ยและส่วนเบี่ยงเบนมาตรฐานของ
sampleแล้วเปรียบเทียบค่าที่ได้กับสถิติของ population เพื่อดูว่ามีความแตกต่างกันหรือไม่
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))
# Set random seed for reproducibility
____.____.____(42)
# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)
# Compare sample statistics to the population statistics
print(" Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))