डॉक्यूमेंट डेटा में हेरफेर
इस पूरे चैप्टर में, आपने Postgres में सेमी-स्ट्रक्चर्ड डॉक्यूमेंट डेटा के साथ काम करने के कई टूल्स देखे हैं. इस अंतिम अभ्यास में, आप इन्हीं सभी टूल्स का इस्तेमाल करके एक analytics-ready डेटासेट बनाएँगे. आप nested_reviews टेबल के साथ काम करेंगे, जिसका रूप नीचे दिखाया गया है.

शुरू करने में मदद के लिए, pandas को pd के रूप में इम्पोर्ट किया गया है, और एक कनेक्शन ऑब्जेक्ट बनाकर वैरिएबल db_engine में रखा गया है. शुभकामनाएँ!
यह अभ्यास पाठ्यक्रम का हिस्सा है
NoSQL परिचय
अभ्यास निर्देश
reviewकॉलम केlocationऑब्जेक्ट से nestedbranchफ़ील्ड को JSON के रूप में लौटाने के लिए#>ऑपरेटर का उपयोग करें. इसेbranchके रूप में एलियस करें.reviewकॉलम मेंstatementफ़ील्ड को->>ऑपरेटर से क्वेरी करें, और परिणाम कोstatementके रूप में एलियस करें.- केवल उन्हीं रिकॉर्ड्स को रखें जहाँ
reviewerका location'Australia'हो. इसके लिएjson_extract_path_textफंक्शन की मदद लें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Extract fields from JSON, and filter by reviewer location
query = """
SELECT
review_id,
____ #> '{____, ____}' AS ____,
____ ->> '____' AS ____,
rating
FROM nested_reviews
WHERE ____(____, '____', '____') = 'Australia'
ORDER BY rating DESC;
"""
data = pd.read_sql(query, db_engine)
print(data)