Bearbeta dokumentdata
Under det här kapitlet har du utforskat ett antal verktyg för att arbeta med semi-strukturerad dokumentdata i Postgres. I den här avslutande övningen sätter du ihop alla dessa verktyg för att skapa ett analysfärdigt dataset. Du arbetar med tabellen nested_reviews, som har formen som visas nedan.

Som en hjälp på vägen har pandas importerats som pd, och ett anslutningsobjekt har skapats och lagrats i variabeln db_engine. Lycka till!
Den här övningen är en del av kursen
Introduktion till NoSQL
Övningsinstruktioner
- Använd operatorn
#>för att returnera det nästlade fältetbranchfrån objektetlocationi kolumnenreview, som JSON. Ge det aliasetbranch. - Hämta fältet
statementi kolumnenreviewmed operatorn->>, och ge resultatet aliasetstatement. - Filtrera resultaten så att endast poster med en
reviewer-plats av'Australia'inkluderas, med hjälp av funktionenjson_extract_path_text.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Extract fields from JSON, and filter by reviewer location
query = """
SELECT
review_id,
____ #> '{____, ____}' AS ____,
____ ->> '____' AS ____,
rating
FROM nested_reviews
WHERE ____(____, '____', '____') = 'Australia'
ORDER BY rating DESC;
"""
data = pd.read_sql(query, db_engine)
print(data)