ปรับแต่งการนำเข้าไฟล์สเปรดชีต
ในแบบฝึกหัดนี้ จะได้ parse สเปรดชีตโดยใช้อาร์กิวเมนต์เพิ่มเติม เพื่อข้ามแถว เปลี่ยนชื่อคอลัมน์ และเลือกเฉพาะคอลัมน์ที่ต้องการ
สเปรดชีต 'battledeath.xlsx' ถูกโหลดเป็น xls ไว้แล้ว
เช่นเดิม จะใช้เมธอด parse() แต่คราวนี้จะเพิ่มอาร์กิวเมนต์
skiprows, names และ usecols ซึ่งใช้สำหรับข้ามแถว กำหนดชื่อคอลัมน์
และระบุคอลัมน์ที่ต้องการ parse ตามลำดับ อาร์กิวเมนต์เหล่านี้รับค่าเป็น list
ที่บรรจุหมายเลขแถว สตริง หรือหมายเลขคอลัมน์ที่ต้องการ แล้วแต่กรณี
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Python เบื้องต้น: การนำเข้าข้อมูล
คำแนะนำการฝึกหัด
- Parse sheet แรกโดยใช้ index โดยข้ามแถวแรกของข้อมูล และกำหนดชื่อคอลัมน์เป็น
'Country'และ'AAM due to War (2002)'ผ่านอาร์กิวเมนต์namesทั้งค่าที่ส่งให้skiprowsและnamesต้องเป็นชนิดlist - Parse sheet ที่สองโดยใช้ index โดย parse เฉพาะคอลัมน์แรกด้วยพารามิเตอร์
usecolsข้ามแถวแรก และเปลี่ยนชื่อคอลัมน์เป็น'Country'โดยค่าที่ส่งให้usecolsก็ต้องเป็นชนิดlistเช่นกัน
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Parse the first sheet and rename the columns: df1
df1 = xls.parse(____, skiprows=____, names=____)
# Print the head of the DataFrame df1
print(df1.head())
# Parse the first column of the second sheet and rename the column: df2
df2 = xls.parse(____, usecols=____, skiprows=____, names=____)
# Print the head of the DataFrame df2
print(df2.head())