or
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
ในบทนี้จะได้เรียนรู้วิธีนำเข้า ทำความสะอาด และรวมข้อมูลจากชีตต่าง ๆ ในไฟล์ Excel เข้าสู่ DataFrame ของ pandas นอกจากนี้ยังได้ฝึกการจัดกลุ่มข้อมูล สรุปข้อมูลตามหมวดหมู่ และแสดงผลด้วยภาพโดยใช้ subplot และ heatmap ข้อมูลที่ใช้เป็นข้อมูลบริษัทที่จดทะเบียนในตลาดหลักทรัพย์ NASDAQ, NYSE และ AMEX ซึ่งประกอบด้วยชื่อบริษัท สัญลักษณ์หุ้น มูลค่าตลาดและราคาล่าสุด กลุ่มอุตสาหกรรม และปีที่ IPO ในบทที่ 2 จะนำข้อมูลนี้ไปต่อยอดเพื่อดาวน์โหลดและวิเคราะห์ประวัติราคาหุ้นของบางบริษัท
บทนี้แนะนำการเข้าถึงข้อมูลออนไลน์จาก Google Finance และ Federal Reserve Data Service ผ่าน `DataReader` ของ `pandas` จะได้ดึงข้อมูล ปรับแต่งเบื้องต้น รวมชุดข้อมูล และแสดงผลลัพธ์ด้วยภาพ
ในบทนี้จะได้เรียนรู้วิธีสรุปลักษณะสำคัญของตัวแปรแต่ละตัวด้วยค่าสถิติที่กระชับ ซึ่งจะช่วยให้เข้าใจการกระจายของตัวแปรในชุดข้อมูลได้ง่ายขึ้น ค่าใดคือค่ากลางหรือค่าที่พบบ่อยที่สุด? ข้อมูลกระจายตัวกว้างหรือกระจุกตัวอยู่รอบจุดกึ่งกลาง? มีค่าผิดปกติหรือไม่? และการกระจายโดยรวมมีรูปแบบอย่างไร?
บทนี้แนะนำการจัดกลุ่มข้อมูลตามตัวแปรเชิงหมวดหมู่หนึ่งตัวหรือมากกว่า รวมถึงการคำนวณและแสดงสถิติสรุปสำหรับแต่ละหมวดหมู่ด้วยภาพ ในกระบวนการนี้จะได้เปรียบเทียบสถิติของบริษัทในภาคส่วนต่าง ๆ และกลุ่มปีที่ IPO วิเคราะห์การกระจายรายได้ทั่วโลกตามช่วงเวลา และเรียนรู้การสร้างกราฟสถิติหลายรูปแบบจากไลบรารี seaborn
แบบฝึกหัดปัจจุบัน