Sestavení ETL pipeline
Připrav se na trochu větší výzvu! V tomto cvičení dokončíš funkci load() a poté spustíš každý krok ETL procesu. Funkce extract() a transform() jsou už připravené. Hodně zdaru!
Toto cvičení je součástí kurzu
ETL a ELT v Pythonu
Pokyny k cvičení
- Dokonči funkci
load()tak, že zapíšeš DataFrametransformed_datado souboru.csvs použitím proměnnéfile_name. - Pomocí funkce
transform()vyčisti DataFrameextracted_data. - Načti
transformed_datado souborutransformed_data.csvpomocí funkceload().
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
def load(data_frame, file_name):
# Write cleaned_data to a CSV using file_name
data_frame.____(____)
print(f"Successfully loaded data to {file_name}")
extracted_data = extract(file_name="raw_data.csv")
# Transform extracted_data using transform() function
transformed_data = ____(data_frame=____)
# Load transformed_data to the file transformed_data.csv
____(data_frame=____, file_name="transformed_data.csv")