Začněte nyníZačněte zdarma

Spuštění ETL pipeline

Připravený/á spustit svůj první ETL pipeline? Pojďme na to!

Funkce extract(), transform() a load() jsou už pro tebe připravené. Ke spuštění tohoto ETL pipeline stačí každou z nich zavolat. Pokud tě zajímá, jak vypadá funkce extract(), mrkni se na ni níže.

def extract(file_name):
    print(f"Extracting data from {file_name}")
    return pd.read_csv(file_name)

Toto cvičení je součástí kurzu

ETL a ELT v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Pomocí funkce extract() načti data ze souboru raw_data.csv.
  • DataFrame extracted_data transformuj pomocí funkce transform().
  • Nakonec načti DataFrame transformed_data do SQL tabulky cleaned_data pomocí funkce load().

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Extract data from the raw_data.csv file
extracted_data = ____(file_name="raw_data.csv")

# Transform the extracted_data
transformed_data = transform(data_frame=____)

# Load the transformed_data to cleaned_data.csv
____(data_frame=transformed_data, target_table="cleaned_data")
Upravit a spustit kód