Tilldela etiketter till rådata
Nu ska du analysera de genomsnittliga RFM-värdena för de tre kluster du skapade i föregående övning. Det råa RFM-datasetet är inläst som datamart_rfm och klusteretiketterna som cluster_labels. pandas är tillgängligt som pd.
Utforska gärna datan i konsolen.
Den här övningen är en del av kursen
Kundsegmentering i Python
Övningsinstruktioner
- Skapa en ny DataFrame genom att lägga till en kolumn med klusteretiketter i
datamart_rfm. - Skapa ett
groupby-element på kolumnenCluster. - Beräkna genomsnittliga RFM-värden och segmentstorlekar för varje värde i
Cluster.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a DataFrame by adding a new cluster label column
datamart_rfm_k3 = datamart_rfm.____(Cluster=cluster_labels)
# Group the data by cluster
grouped = ____.____(['____'])
# Calculate average RFM values and segment sizes per cluster value
grouped.____({
'Recency': '____',
'Frequency': '____',
'MonetaryValue': ['____', '____']
}).round(1)