Łączenie danych wejściowych za pomocą zip
Twój zespół ma pipeline, który przesyła pliki do określonych lokalizacji w chmurze. Kolega używa zip() z expand_kwargs(), żeby sparować każdy plik z odpowiednim miejscem docelowym w chmurze:
@task
def get_files():
return ["users.csv", "orders.csv", "products.csv"]
@task
def get_destinations():
return ["s3://bronze/users/", "s3://bronze/orders/", "s3://bronze/products/"]
@task
def upload(file_to_upload):
# Simulate uploading a file to cloud storage
print(f"Uploading {file_to_upload[0]} to {file_to_upload[1]}")
files = get_files()
destinations = get_destinations()
upload.expand(file_to_upload=files.zip(destinations))
Ile instancji zadania upload utworzy Airflow?
To ćwiczenie jest częścią kursu
Budowanie potoków danych z Airflow
Interaktywne ćwiczenie praktyczne
Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń
Rozpocznij ćwiczenie