โหลดข้อมูลบางส่วนจากสเปรดชีต
สเปรดชีตที่ออกแบบมาเพื่อให้มนุษย์อ่านมักมีหลายตารางในชีตเดียว เช่น ธุรกิจขนาดเล็กอาจเก็บ workbook สินค้าคงคลังที่มีตารางสำหรับผลิตภัณฑ์แต่ละประเภทไว้ในชีตเดียวกัน แม้แต่ข้อมูลแบบตารางก็อาจมีแถว header ที่เป็น metadata เช่นในข้อมูล New Developer Survey ที่ใช้ที่นี่ metadata มีประโยชน์ แต่เราไม่ต้องการให้อยู่ใน dataframe คุณจะใช้ keyword skiprows ของ read_excel() เพื่อดึงเฉพาะข้อมูล และสร้าง string เพื่อส่งให้ usecols เพื่อดึงเฉพาะคอลัมน์ AD และ AW ถึง BA ซึ่งเกี่ยวกับเป้าหมายอาชีพในอนาคต
ได้ import pandas เป็น pd แล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การนำเข้าข้อมูลด้วย pandas อย่างมีประสิทธิภาพ
คำแนะนำการฝึกหัด
- สร้าง string เดียวชื่อ
col_stringเพื่อระบุให้pandasโหลดคอลัมน์ADและ ช่วงAWถึงBA - โหลด
fcc_survey_headers.xlsxโดยกำหนดskiprowsและusecolsเพื่อข้ามสองแถวแรกที่เป็น metadata และดึงเฉพาะคอลัมน์ในcol_string - ดูชื่อคอลัมน์ที่เลือกใน dataframe ที่ได้
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Create string of lettered columns to load
col_string = ____
# Load data with skiprows and usecols set
survey_responses = ____("fcc_survey_headers.xlsx",
____,
____)
# View the names of the columns selected
print(survey_responses.columns)