過去,Sierra Publishing 的資料科學家只在公司筆電上訓練機器學習模型。因此,他們熟悉並建立了單節點機器學習框架的流程,但在將模型部署到正式環境時常需要協助。他們需要了解單節點與多節點機器學習流程之間的差異。
身為首席資料科學家,你已深入研究 Databricks,並認為自己已充分理解這兩種做法的不同。
本練習屬於課程
將理論付諸實踐,立即體驗我們的互動練習
了解雲端資料策略中的新 Lakehouse 範式,以及 Databricks Lakehouse 平台如何讓你的資料架構現代化。認識 Databricks 平台的基礎元件,以及它們如何彼此整合。
學習使用 Databricks 的功能來處理、轉換與清理你的資料。實作 Delta 儲存格式、Delta Live Tables 與 Workflows 等能力,將它們結合起來建立端到端的資料管線。
將 Databricks Lakehouse 平台作為你的資料倉儲解決方案,以支援商業智慧(BI)情境。使用 Databricks 內建、為 SQL 最佳化的功能,在你的資料上建立查詢與儀表板。
使用 Databricks 以受管的 MLFlow 管理你的機器學習管線。透過 Feature Store、Model Registry 與 Model Serving Endpoints,從端到端走過模型開發生命週期,在 Lakehouse 中打造健全的 MLOps 平台。
當前練習