Ukládání dat do souborů
Načtení dat do cílového úložiště je jedním z nejdůležitějších kroků datového pipeline. V tomto cvičení použiješ funkci transform() zobrazenou níže k transformaci dat o prodeji produktů a poté je uložíš do souboru .csv. Díky tomu budou mít spotřebitelé dat přehled o celkových tržbách napříč celou řadou produktů.
Pro toto cvičení jsou prodejní data již načtena a transformována a uložena v DataFrame clean_sales_data. Balíček pandas je importován jako pd a knihovna os je také připravena k použití!
Toto cvičení je součástí kurzu
ETL a ELT v Pythonu
Pokyny k cvičení
- Uprav funkci
load()tak, aby zapisovala data na zadanou cestu bez záhlaví a indexového sloupce. - Ověř, že byl soubor uložen na požadovanou cestu.
- Zavolej funkci, která načte transformovaná data do trvalého úložiště.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
def load(clean_data, file_path):
# Write the data to a file
clean_data.to_csv(file_path, ____, ____)
# Check to make sure the file exists
file_exists = os.____.____(____)
if not file_exists:
raise Exception(f"File does NOT exists at path {file_path}")
# Load the transformed data to the provided file path
____(clean_sales_data, "transformed_sales_data.csv")