บันทึกข้อมูลลงไฟล์
การโหลดข้อมูลไปยังปลายทางสุดท้ายถือเป็นหนึ่งในขั้นตอนที่สำคัญที่สุดของ data pipeline ในแบบฝึกหัดนี้ คุณจะใช้ฟังก์ชัน transform() ที่แสดงด้านล่างเพื่อแปลงข้อมูลยอดขายสินค้า ก่อนโหลดลงไฟล์ .csv ซึ่งจะช่วยให้ผู้ใช้ข้อมูลปลายทางเห็นภาพรวมของยอดขายทั้งหมดในช่วงผลิตภัณฑ์ต่าง ๆ ได้ชัดเจนขึ้น
สำหรับแบบฝึกหัดนี้ ข้อมูลยอดขายถูกโหลดและแปลงแล้ว และเก็บอยู่ใน DataFrame ชื่อ clean_sales_data โดยแพ็กเกจ pandas ถูก import เป็น pd และไลบรารี os พร้อมใช้งานแล้ว!
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
ETL และ ELT ด้วย Python
คำแนะนำการฝึกหัด
- อัปเดตฟังก์ชัน
load()ให้เขียนข้อมูลไปยัง path ที่กำหนด โดยไม่ต้องมี header หรือคอลัมน์ index - ตรวจสอบว่าไฟล์ถูกโหลดไปยัง file path ที่ต้องการเรียบร้อยแล้ว
- เรียกใช้ฟังก์ชันเพื่อโหลดข้อมูลที่แปลงแล้วไปยัง persistent storage
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
def load(clean_data, file_path):
# Write the data to a file
clean_data.to_csv(file_path, ____, ____)
# Check to make sure the file exists
file_exists = os.____.____(____)
if not file_exists:
raise Exception(f"File does NOT exists at path {file_path}")
# Load the transformed data to the provided file path
____(clean_sales_data, "transformed_sales_data.csv")