開始使用免費開始

巢狀電影資料

你對電腦裡放了一陣子的 movies 資料集很好奇,裡面包含不同電影的資料。你想分析這些資料,但發現它是巢狀的 JSON 格式。

若要把它讀入成為 DataFrame,你需要使用剛學到的函式。之後,你會重塑得到的 DataFrame,讓它更容易操作。

半結構化的 JSON(名稱為 movies)已提供給你。請務必在主控台中先檢視它!

本練習屬於課程

使用 pandas 重塑資料

檢視課程

練習說明

  • pandas 匯入 json_normalize() 函式。
  • movies 中的 JSON 正規化。對於由巢狀紀錄產生的欄位名稱,請以底線分隔。
  • 將產生的 movies_norm DataFrame 從寬格式轉為長格式,並使用 directorproducer 欄作為唯一索引。將由欄位 movies 建立的新變數命名為以 features 開頭、以底線分隔,且後綴為英文字詞。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Import the json_normalize function
____

# Normalize movies and separate the new columns with an underscore 
movies_norm = ____(____, sep=____)

# Reshape using director and producer as index, create movies from column starting from features
movies_long = pd.____(____, stubnames=____, 
                      i=____, j=____, 
                      sep=____, suffix=____)

# Print movies_long
print(movies_long)
編輯並執行程式碼