執行 ETL pipeline
準備好執行你的第一個 ETL pipeline 了嗎?一起開始吧!
這裡已經為你定義好 extract()、transform() 和 load() 等函式。要執行這個資料 ETL pipeline,你將依序呼叫這些函式。若你想看看,下面是 extract() 函式的樣子。
def extract(file_name):
print(f"Extracting data from {file_name}")
return pd.read_csv(file_name)
本練習屬於課程
使用 Python 的 ETL 與 ELT
練習說明
- 使用
extract()從raw_data.csv檔案擷取資料。 - 使用
transform()轉換extracted_dataDataFrame。 - 最後,將
transformed_dataDataFrame 載入到cleaned_dataSQL 資料表。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Extract data from the raw_data.csv file
extracted_data = ____(file_name="raw_data.csv")
# Transform the extracted_data
transformed_data = transform(data_frame=____)
# Load the transformed_data to cleaned_data.csv
____(data_frame=transformed_data, target_table="cleaned_data")