शुरू करेंमुफ़्त में शुरू करें

parquet फ़ाइल से dataframe लोड करना

आपके वर्कस्पेस में sherlock_sentences.parquet नाम की एक dataframe फ़ाइल उपलब्ध है. इस dataframe की हर पंक्ति में एक एकल clause है. हर clause शब्दों का एक क्रम है जो अन्य clauses से विराम-चिह्नों, जैसे period, quotes, और अन्य natural language delimiters द्वारा अलग होता है जो एक वाक्य या वाक्य-खंड को दर्शाते हैं. आपका काम है — अगर आप इसे स्वीकार करें — तो इस फ़ाइल को लोड करना.

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Spark SQL परिचय

पाठ्यक्रम देखें

अभ्यास निर्देश

  • sherlock_sentences.parquet लोड करें.
  • "id > 70" पर filter करें, और पहली 5 पंक्तियाँ दिखाएँ.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Load the dataframe
df = ____('sherlock_sentences.parquet')

# Filter and show the first 5 rows
df.where('id > 70').____(____, truncate=False)
कोड संपादित करें और चलाएँ