兩個類別的摘要統計
請參考以下的 .groupby() 程式碼:
# 依據 x 分組並計算標準差
df.groupby(['x']).std()
在這裡,df 這個 DataFrame 會依欄位 'x' 分組,接著對於每個 'x' 的值,計算 df 中所有欄位的標準差。當你想要針對資料集中的特定欄位做分析時,.groupby() 方法非常實用。接下來,你要進一步探索 'Churn' 欄位,看看流失與未流失的使用者之間是否有差異。你的工作空間中已提供 telco DataFrame 的一個子集,包含欄位 'Churn'、'CustServ_Calls' 與 'Vmail_Message'。
如果你需要複習 .groupby() 的用法,請回到先修課程 Manipulating DataFrames with pandas 參考。
本練習屬於課程
行銷分析:用 Python 預測客戶流失
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Group telco by 'Churn' and compute the mean
print(telco.____(['____']).____())