डेटा पाइपलाइन के चरण
Sierra Publishing में आपकी एक अधिक व्यवसाय-महत्वपूर्ण डेटा पाइपलाइन उच्च-वेग वाली डेटा स्ट्रीम पर निर्भर करती है, जो Kafka डेटा स्ट्रीम से आती है. हमें डेटा को पढ़ना है और कुछ अन्य डेटासेट्स के साथ उसे जॉइन करना है.

आपकी डेटा इंजीनियरिंग टीम Databricks का उपयोग करके इस डेटा पाइपलाइन को अधिक कुशल बनाना चाहती है और डाउनस्ट्रीम कंज़्यूमर्स को अपनी एनालिटिक्स के लिए इस डेटा को रियल-टाइम में पढ़ने देना चाहती है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Databricks कॉन्सेप्ट्स
इंटरैक्टिव व्यावहारिक अभ्यास
हमारे इंटरैक्टिव अभ्यासों में से किसी एक के साथ सिद्धांत को व्यवहार में बदलें
अभ्यास शुरू करें