शुरू करेंमुफ़्त में शुरू करें

डॉक्यूमेंट डेटा में हेरफेर

इस पूरे चैप्टर में, आपने Postgres में सेमी-स्ट्रक्चर्ड डॉक्यूमेंट डेटा के साथ काम करने के कई टूल्स देखे हैं. इस अंतिम अभ्यास में, आप इन्हीं सभी टूल्स का इस्तेमाल करके एक analytics-ready डेटासेट बनाएँगे. आप nested_reviews टेबल के साथ काम करेंगे, जिसका रूप नीचे दिखाया गया है.

nested_reviews table, showing sample data.

शुरू करने में मदद के लिए, pandas को pd के रूप में इम्पोर्ट किया गया है, और एक कनेक्शन ऑब्जेक्ट बनाकर वैरिएबल db_engine में रखा गया है. शुभकामनाएँ!

यह अभ्यास पाठ्यक्रम का हिस्सा है

NoSQL परिचय

पाठ्यक्रम देखें

अभ्यास निर्देश

  • review कॉलम के location ऑब्जेक्ट से nested branch फ़ील्ड को JSON के रूप में लौटाने के लिए #> ऑपरेटर का उपयोग करें. इसे branch के रूप में एलियस करें.
  • review कॉलम में statement फ़ील्ड को ->> ऑपरेटर से क्वेरी करें, और परिणाम को statement के रूप में एलियस करें.
  • केवल उन्हीं रिकॉर्ड्स को रखें जहाँ reviewer का location 'Australia' हो. इसके लिए json_extract_path_text फंक्शन की मदद लें.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Extract fields from JSON, and filter by reviewer location
query = """
    SELECT
    	review_id,
        ____ #> '{____, ____}' AS ____,
        ____ ->> '____' AS ____,
        rating
    FROM nested_reviews
    WHERE ____(____, '____', '____') = 'Australia'
    ORDER BY rating DESC;
"""

data = pd.read_sql(query, db_engine)
print(data)
कोड संपादित करें और चलाएँ