Spuštění ETL pipeline
Připravený/á spustit svůj první ETL pipeline? Pojďme na to!
Funkce extract(), transform() a load() jsou už pro tebe připravené. Ke spuštění tohoto ETL pipeline stačí každou z nich zavolat. Pokud tě zajímá, jak vypadá funkce extract(), mrkni se na ni níže.
def extract(file_name):
print(f"Extracting data from {file_name}")
return pd.read_csv(file_name)
Toto cvičení je součástí kurzu
ETL a ELT v Pythonu
Pokyny k cvičení
- Pomocí funkce
extract()načti data ze souboruraw_data.csv. - DataFrame
extracted_datatransformuj pomocí funkcetransform(). - Nakonec načti DataFrame
transformed_datado SQL tabulkycleaned_datapomocí funkceload().
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Extract data from the raw_data.csv file
extracted_data = ____(file_name="raw_data.csv")
# Transform the extracted_data
transformed_data = transform(data_frame=____)
# Load the transformed_data to cleaned_data.csv
____(data_frame=transformed_data, target_table="cleaned_data")