Začněte nyníZačněte zdarma

Ukládání dat do souborů

Načtení dat do cílového úložiště je jedním z nejdůležitějších kroků datového pipeline. V tomto cvičení použiješ funkci transform() zobrazenou níže k transformaci dat o prodeji produktů a poté je uložíš do souboru .csv. Díky tomu budou mít spotřebitelé dat přehled o celkových tržbách napříč celou řadou produktů.

Pro toto cvičení jsou prodejní data již načtena a transformována a uložena v DataFrame clean_sales_data. Balíček pandas je importován jako pd a knihovna os je také připravena k použití!

Toto cvičení je součástí kurzu

ETL a ELT v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Uprav funkci load() tak, aby zapisovala data na zadanou cestu bez záhlaví a indexového sloupce.
  • Ověř, že byl soubor uložen na požadovanou cestu.
  • Zavolej funkci, která načte transformovaná data do trvalého úložiště.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

def load(clean_data, file_path):
    # Write the data to a file
    clean_data.to_csv(file_path, ____, ____)

    # Check to make sure the file exists
    file_exists = os.____.____(____)
    if not file_exists:
        raise Exception(f"File does NOT exists at path {file_path}")

# Load the transformed data to the provided file path
____(clean_sales_data, "transformed_sales_data.csv")
Upravit a spustit kód