कंपनी के आधार पर फ़िल्टर करना
पिछले अभ्यास वाले उसी डेटासेट का उपयोग करते हुए, आपने समझा कि आपको केवल एंट्री-लेवल ("EN") और कनाडा ("CA") की नौकरियों की परवाह है. वहाँ सैलरी कैसी दिखती है?
ध्यान रखें, आपके वर्कस्पेस में पहले से एक SparkSession spark नाम से मौजूद है!
यह अभ्यास पाठ्यक्रम का हिस्सा है
PySpark परिचय
अभ्यास निर्देश
- DataFrame को फ़िल्टर करके केवल वे पंक्तियाँ रखें जहाँ
company_location"CA"हो. salary_in_usdकॉलम का औसत निकालें.- परिणाम दिखाएँ!
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()