巢狀電影資料
你對電腦裡放了一陣子的 movies 資料集很好奇,裡面包含不同電影的資料。你想分析這些資料,但發現它是巢狀的 JSON 格式。
若要把它讀入成為 DataFrame,你需要使用剛學到的函式。之後,你會重塑得到的 DataFrame,讓它更容易操作。
半結構化的 JSON(名稱為 movies)已提供給你。請務必在主控台中先檢視它!
本練習屬於課程
使用 pandas 重塑資料
練習說明
- 從
pandas匯入json_normalize()函式。 - 將
movies中的 JSON 正規化。對於由巢狀紀錄產生的欄位名稱,請以底線分隔。 - 將產生的
movies_normDataFrame 從寬格式轉為長格式,並使用director與producer欄作為唯一索引。將由欄位movies建立的新變數命名為以features開頭、以底線分隔,且後綴為英文字詞。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Import the json_normalize function
____
# Normalize movies and separate the new columns with an underscore
movies_norm = ____(____, sep=____)
# Reshape using director and producer as index, create movies from column starting from features
movies_long = pd.____(____, stubnames=____,
i=____, j=____,
sep=____, suffix=____)
# Print movies_long
print(movies_long)