Créer une segmentation avec le regroupement k-means
Dans cet exercice, vous allez créer une segmentation de la clientèle avec l'algorithme KMeans. Comme vous l'avez vu à l'étape précédente, le nombre optimal de grappes sur le plan mathématique se situe autour de 3 ou 4. Ici, vous en créerez une avec 4 segments.
Le jeu de données prétraité a été chargé sous le nom wholesale_scaled_df. Vous l'utiliserez pour exécuter l'algorithme KMeans, et le jeu de données brut non prétraité sous le nom wholesale — vous l'utiliserez ensuite pour explorer les valeurs moyennes des colonnes pour les 4 segments que vous allez créer.
Cette activité fait partie du cours
Machine Learning pour le marketing en Python
Instructions de l’exercice
- Importez l'algorithme
KMeansdu modulesklearn.cluster. - Initialisez l'algorithme
KMeansavec 4 grappes (clusters) et un état aléatoire fixé à 123. - Ajustez le modèle sur le jeu de données prétraité
wholesale_scaled_df. - Attribuez les étiquettes générées à une nouvelle colonne appelée
segmentdans le jeu de données brutwholesale.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Import `KMeans` module
from sklearn.cluster import ___
# Initialize `KMeans` with 4 clusters
kmeans=KMeans(___=4, random_state=123)
# Fit the model on the pre-processed dataset
kmeans.fit(___)
# Assign the generated labels to a new column
wholesale_kmeans4 = wholesale.assign(segment = kmeans.___)