Práce s dokumentovými daty
V průběhu této kapitoly jsi prozkoumával/a celou řadu nástrojů pro práci s polostrukturovanými dokumentovými daty v Postgresu. V tomto závěrečném cvičení je všechny využiješ k vytvoření datasetu připraveného pro analýzu. Budeš pracovat s tabulkou nested_reviews, která má podobu zobrazenou níže.

Pro snazší start je k dispozici pandas importovaný jako pd a objekt připojení uložený v proměnné db_engine. Hodně štěstí!
Toto cvičení je součástí kurzu
Úvod do NoSQL
Pokyny k cvičení
- Pomocí operátoru
#>vrať vnořené polebranchz objektulocationve sloupcireviewjako JSON. Výsledek pojmenuj aliasembranch. - Dotaž se na pole
statementve sloupcireviewpomocí operátoru->>a výsledku přiřaď aliasstatement. - Vyfiltruj výsledky tak, aby zahrnovaly pouze záznamy, kde je lokace
reviewerrovna'Australia'– využij k tomu funkcijson_extract_path_text.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Extract fields from JSON, and filter by reviewer location
query = """
SELECT
review_id,
____ #> '{____, ____}' AS ____,
____ ->> '____' AS ____,
rating
FROM nested_reviews
WHERE ____(____, '____', '____') = 'Australia'
ORDER BY rating DESC;
"""
data = pd.read_sql(query, db_engine)
print(data)