两类客户的汇总统计
请考虑下面的 .groupby() 代码:
# 按 x 分组并计算标准差
df.groupby(['x']).std()
这里,DataFrame df 按列 'x' 分组,然后对每个 'x' 的取值,计算 df 所有列的标准差。.groupby() 方法在您需要按数据集的特定列进行分析时非常有用。接下来,您将进一步探索 'Churn' 列,看看流失客户与未流失客户之间是否存在差异。工作区中已提供 telco DataFrame 的一个子集,包含列 'Churn'、'CustServ_Calls' 和 'Vmail_Message'。
如果您需要回顾 .groupby() 的用法,请参阅先修课程 Manipulating DataFrames with pandas。
本练习是课程的一部分
营销分析:用 Python 预测客户流失
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Group telco by 'Churn' and compute the mean
print(telco.____(['____']).____())