शुरू करेंमुफ़्त में शुरू करें

Census डेटा लोड करना

चलिए आपका पहला PySpark DataFrame बनाना शुरू करते हैं! फ़ाइल adult_reduced.csv में वयस्कों को विभिन्न डेमोग्राफिक श्रेणियों के आधार पर ग्रुप किया गया है। ये डेटा US Census से अनुकूलित किए गए हैं। कुल 32562 वयस्क समूह शामिल हैं.

हमें CSV लोड करना चाहिए और प्राप्त स्कीमा देखना चाहिए.

डेटा डिक्शनरी:

वैरिएबल विवरण
age व्यक्ति की आयु
education_num डिग्री के अनुसार शिक्षा
marital_status वैवाहिक स्थिति
occupation व्यवसाय
income श्रेणीबद्ध आय

यह अभ्यास पाठ्यक्रम का हिस्सा है

PySpark परिचय

पाठ्यक्रम देखें

अभ्यास निर्देश

  • spark.read.csv() मेथड का उपयोग करके "adult_reduced.csv" फ़ाइल से एक PySpark DataFrame बनाएँ.
  • प्राप्त DataFrame को दिखाएँ.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Read in the CSV
census_adult = ____.____.____(____)

# Show the DataFrame
census_adult.____
कोड संपादित करें और चलाएँ