क्वेरी प्लान पढ़ने का अभ्यास 2
तीन डेटाफ़्रेम उपलब्ध हैं: part2_df, part3_df, और part4_df. इस अभ्यास के प्रश्नों के उत्तर प्रत्येक डेटाफ़्रेम के explain() आउटपुट को देखकर दिए जा सकते हैं.
ध्यान दें कि Spark हर कॉलम नाम के साथ एक डेस्क्रिप्टर जोड़ता है, जिसे # सिंबल से अलग किया जाता है. उदाहरण के लिए, word#0, id#1L, part#2, और title#3. इस अभ्यास के उद्देश्य से, आप इन डेस्क्रिप्टरों को नज़रअंदाज़ कर सकते हैं.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Spark SQL परिचय
इंटरैक्टिव व्यावहारिक अभ्यास
हमारे इंटरैक्टिव अभ्यासों में से किसी एक के साथ सिद्धांत को व्यवहार में बदलें
अभ्यास शुरू करें