parquet फ़ाइल से dataframe लोड करना
आपके वर्कस्पेस में sherlock_sentences.parquet नाम की एक dataframe फ़ाइल उपलब्ध है. इस dataframe की हर पंक्ति में एक एकल clause है. हर clause शब्दों का एक क्रम है जो अन्य clauses से विराम-चिह्नों, जैसे period, quotes, और अन्य natural language delimiters द्वारा अलग होता है जो एक वाक्य या वाक्य-खंड को दर्शाते हैं. आपका काम है — अगर आप इसे स्वीकार करें — तो इस फ़ाइल को लोड करना.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Spark SQL परिचय
अभ्यास निर्देश
sherlock_sentences.parquetलोड करें.- "id > 70" पर filter करें, और पहली 5 पंक्तियाँ दिखाएँ.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Load the dataframe
df = ____('sherlock_sentences.parquet')
# Filter and show the first 5 rows
df.where('id > 70').____(____, truncate=False)