開始使用免費開始

執行 ETL pipeline

準備好執行你的第一個 ETL pipeline 了嗎?一起開始吧!

這裡已經為你定義好 extract()transform()load() 等函式。要執行這個資料 ETL pipeline,你將依序呼叫這些函式。若你想看看,下面是 extract() 函式的樣子。

def extract(file_name):
    print(f"Extracting data from {file_name}")
    return pd.read_csv(file_name)

本練習屬於課程

使用 Python 的 ETL 與 ELT

檢視課程

練習說明

  • 使用 extract()raw_data.csv 檔案擷取資料。
  • 使用 transform() 轉換 extracted_data DataFrame。
  • 最後,將 transformed_data DataFrame 載入到 cleaned_data SQL 資料表。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Extract data from the raw_data.csv file
extracted_data = ____(file_name="raw_data.csv")

# Transform the extracted_data
transformed_data = transform(data_frame=____)

# Load the transformed_data to cleaned_data.csv
____(data_frame=transformed_data, target_table="cleaned_data")
編輯並執行程式碼