有一條監控管線每小時檢查一次 API 的健康狀態。當 API 因維護而停機時,這條管線會不斷失敗,並向待命通報頻道灌入大量警示。Airflow 可以在連續失敗後自動暫停 Dag 來止住雜訊,而 callback 則能在每次失敗時紀錄發生了什麼問題的脈絡。
你將結合這兩個功能,讓團隊保持掌握情況,同時避免警示疲勞。
本練習屬於課程
將理論付諸實踐,立即體驗我們的互動練習
你將先認識 Airflow 的元件,使用 TaskFlow API 撰寫你的第一個 Dags,並透過 XCom 在任務之間傳遞資料。
接著,你會用動態任務對映平行執行任務,使用 Assets 以資料為基準排程 Dags,並加入人工核准步驟。
本章將透過重試與回呼處理失敗情況,使用可延後的感測器節省資源,並以三個層級測試你的 Dags。
當前練習
在最後一章,你會在 DuckDB 上建置 SQL ETL 管線,使用 Asset Partitions 加入分割區感知的排程,並內嵌資料品質檢查。