मल्टी-टास्क जॉब पाइपलाइन बनाना
Global Retail Analytics में आपकी टीम ने डेटा पाइपलाइन को तीन नोटबुक्स में बाँटा है: task1_ingest कच्चे CSV को क्लीन करता है और एक Delta टेबल लिखता है, task2_revenue देश के आधार पर रेवेन्यू एग्रीगेट करता है, और task3_top_customers खर्च के आधार पर कस्टमर्स की रैंकिंग करता है। तीनों Exercises फ़ोल्डर में पहले से मौजूद हैं.
आपका काम है इन्हें एक Databricks Job में जोड़ना, पाइपलाइन चलाना, और आने वाली किसी भी गलती को ठीक करना.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Databricks में Spark SQL के साथ Data Transformation
इंटरैक्टिव व्यावहारिक अभ्यास
हमारे इंटरैक्टिव अभ्यासों में से किसी एक के साथ सिद्धांत को व्यवहार में बदलें
अभ्यास शुरू करें