你的團隊正在執行一個從外部 API 擷取天氣資料的管線。這個 API 偶爾會在尖峰時段逾時,但這些都是暫時性的失敗,通常會自行恢復。
若使用固定延遲的簡單重試,在服務中斷時可能會造成 API 壓力過大,因此這個任務需要一種策略,讓每次重試之間的等待時間逐步拉長,給端點更多時間恢復。
本練習屬於課程
將理論付諸實踐,立即體驗我們的互動練習
你將先認識 Airflow 的元件,使用 TaskFlow API 撰寫你的第一個 Dags,並透過 XCom 在任務之間傳遞資料。
接著,你會用動態任務對映平行執行任務,使用 Assets 以資料為基準排程 Dags,並加入人工核准步驟。
本章將透過重試與回呼處理失敗情況,使用可延後的感測器節省資源,並以三個層級測試你的 Dags。
當前練習
在最後一章,你會在 DuckDB 上建置 SQL ETL 管線,使用 Asset Partitions 加入分割區感知的排程,並內嵌資料品質檢查。