शुरू करेंमुफ़्त में शुरू करें

Complex Aggregations

आप को बिल्ट-इन एग्रीगेशन मेथड्स से और सहज कराने के लिए, आइए थोड़ा अधिक कॉम्प्लेक्स एग्रीगेशन करें! लक्ष्य है कि इन सभी कमांड्स को एक ही लाइन में जोड़ दिया जाए.

ध्यान रखें, spark नाम की एक SparkSession आपके वर्कस्पेस में पहले से मौजूद है, साथ ही Spark DataFrame salaries_df भी.

यह अभ्यास पाठ्यक्रम का हिस्सा है

PySpark परिचय

पाठ्यक्रम देखें

अभ्यास निर्देश

  • "salary_in_usd" कॉलम का उपयोग करके बड़ी US कंपनियों के औसत वेतन की गणना करें.
  • बड़ी US कंपनियों के कुल वेतन की गणना करें.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Average salaries at large us companies
large_companies=salaries_df.filter(salaries_df.company_size == "L").filter(salaries_df.company_location == "US").groupBy().____

#set a large companies variable for other analytics
large_companies=salaries_df.filter(salaries_df.company_size == "L").filter(salaries_df.company_location == "US")

# Total salaries in usd
large_companies.groupBy().____.show()
कोड संपादित करें और चलाएँ