โหลดข้อมูลรายชื่อหลักทรัพย์จากสองชีต
กระบวนการนำเข้าข้อมูลนั้นใช้งานง่ายเช่นกันเมื่อใช้แอตทริบิวต์ sheet_names ของออบเจ็กต์ pd.ExcelFile()
การส่งลิสต์เป็นอาร์กิวเมนต์ sheet_name ของ pd.read_excel() ไม่ว่าจะกำหนดลิสต์นั้นให้กับตัวแปรที่เก็บแอตทริบิวต์ sheet_names ของออบเจ็กต์ pd.ExcelFile() หรือพิมพ์ลิสต์โดยตรง จะสร้างเป็น dictionary โดย key คือชื่อชีต และ value คือ DataFrame ที่บรรจุข้อมูลจากชีตนั้น ๆ สามารถดึงค่าจาก dictionary ได้โดยระบุ key ที่ต้องการในวงเล็บเหลี่ยม
ในแบบฝึกหัดนี้ จะดึงรายชื่อตลาดหลักทรัพย์จาก listings.xlsx แล้วใช้รายชื่อดังกล่าวเพื่ออ่านข้อมูลของทั้งสามตลาดลงใน dictionary นำเข้า pandas เป็น pd แล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การนำเข้าและจัดการข้อมูลทางการเงินใน Python
คำแนะนำการฝึกหัด
- สร้างออบเจ็กต์
pd.ExcelFile()โดยใช้ไฟล์'listings.xlsx'แล้วกำหนดให้กับตัวแปรxls - บันทึกแอตทริบิวต์
sheet_namesของxlsไว้ในตัวแปรexchanges - ใช้
exchangesเพื่อระบุชื่อชีต และใช้n/aเพื่อระบุค่าที่หายไปในpd.read_excel()จากนั้นอ่านข้อมูลจากทุกชีตในxlsแล้วกำหนดให้กับ dictionary ชื่อlistings - ตรวจสอบเฉพาะข้อมูล
'nasdaq'ใน dictionary ใหม่นี้ด้วย.info()
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Create pd.ExcelFile() object
xls = ____('listings.xlsx')
# Extract sheet names and store in exchanges
exchanges = xls.____
# Create listings dictionary with all sheet data
listings = pd.____(xls, ____=____, ____='n/a')
# Inspect NASDAQ listings
listings[____].info()