始める無料で始める

ドキュメントデータの抽出

この演習では、nested_reviews テーブルの review 列をクエリするために、json_extract_pathjson_extract_path_text 関数を使う練習をします。テーブルは下図のとおりです。

nested_reviews table, showing sample data.

接続オブジェクトは作成済みで、変数 db_engine に保存されています。pandaspd としてインポート済みです。頑張ってください!

この演習はコースの一部です

NoSQL入門

コースを見る

演習の手順

  • json_extract_path 関数を使って、nested_reviews テーブルの review 列にある statement フィールドの値を取得してください。
  • json_extract_path_text 関数を使って、ネストされた reviewer フィールドを取得してください。
  • JSON データからテキストとして抽出した branch 情報が 'Disneyland_California' に一致するレコードだけが含まれるように、クエリを絞り込んでください。適切な関数で JSON 構造をたどり、このフィールドを取り出してフィルタしましょう。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Return the statement and reviewer fields, filter by the 
# nested branch field
query = """
    SELECT 
        ____(review, '____'),
        ____
    FROM nested_reviews
    WHERE ____(____, '____', '____') = 'Disneyland_California';
"""

data = pd.read_sql(query, db_engine)
print(data)
コードを編集して実行