शुरू करेंमुफ़्त में शुरू करें

Spark UI में cache जाँचना

एक dataframe partitioned_df उपलब्ध है. इससे text नाम की एक temporary table रजिस्टर की जाती है. उसके बाद spark.catalog.cacheTable('text') का उपयोग करके text को cache किया जाता है. यदि आप Spark को लोकल चला रहे होते, तो Spark UI http://localhost:4040/storage/ पर उपलब्ध होता. इस अभ्यास के उद्देश्य से, नीचे दी गई इमेज देखें. यह दिखाती है कि text के cache के लोड हो जाने के बाद Spark UI क्या दिखाएगा:

Spark UI Storage

यह दर्शाता है कि text नाम की एक table, जिसके सात partitions हैं, मेमोरी में cache है. निम्नलिखित में से कौन-सा तुरंत ऊपर दिखाया गया दृश्य Spark UI में प्रकट कर देगा?

  1. आधारभूत dataframe पर कोई transform करना, उदाहरण के लिए df = partitioned_df.distinct().

  2. आधारभूत dataframe को count करना, उदाहरण: partitioned_df.count()

  3. table पर क्वेरी चलाना, जैसे: spark.sql("select count(*) from text")

  4. क्वेरी चलाकर परिणाम दिखाना, जैसे: spark.sql("select count(*) from text").show()

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Spark SQL परिचय

पाठ्यक्रम देखें

इंटरैक्टिव व्यावहारिक अभ्यास

हमारे इंटरैक्टिव अभ्यासों में से किसी एक के साथ सिद्धांत को व्यवहार में बदलें

अभ्यास शुरू करें