Začněte nyníZačněte zdarma

Práce s dokumentovými daty

V průběhu této kapitoly jsi prozkoumával/a celou řadu nástrojů pro práci s polostrukturovanými dokumentovými daty v Postgresu. V tomto závěrečném cvičení je všechny využiješ k vytvoření datasetu připraveného pro analýzu. Budeš pracovat s tabulkou nested_reviews, která má podobu zobrazenou níže.

nested_reviews table, showing sample data.

Pro snazší start je k dispozici pandas importovaný jako pd a objekt připojení uložený v proměnné db_engine. Hodně štěstí!

Toto cvičení je součástí kurzu

Úvod do NoSQL

Zobrazit kurz

Pokyny k cvičení

  • Pomocí operátoru #> vrať vnořené pole branch z objektu location ve sloupci review jako JSON. Výsledek pojmenuj aliasem branch.
  • Dotaž se na pole statement ve sloupci review pomocí operátoru ->> a výsledku přiřaď alias statement.
  • Vyfiltruj výsledky tak, aby zahrnovaly pouze záznamy, kde je lokace reviewer rovna 'Australia' – využij k tomu funkci json_extract_path_text.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Extract fields from JSON, and filter by reviewer location
query = """
    SELECT
    	review_id,
        ____ #> '{____, ____}' AS ____,
        ____ ->> '____' AS ____,
        rating
    FROM nested_reviews
    WHERE ____(____, '____', '____') = 'Australia'
    ORDER BY rating DESC;
"""

data = pd.read_sql(query, db_engine)
print(data)
Upravit a spustit kód