Sestavení řešení se 4 clustery
Výborně! Jak vidíš, doporučený počet clusterů se pohybuje někde mezi 3 a 4. V tomto cvičení sestavíš řešení s vyšším z těchto čísel.
Normalizovaný dataset RFMT je k dispozici jako datamart_rfmt_normalized – klidně ho prozkoumej v konzoli.
Toto cvičení je součástí kurzu
Segmentace zákazníků v Pythonu
Pokyny k cvičení
- Importuj
KMeansz knihovnysklearn. - Inicializuj
KMeansse 4 clustery a náhodným stavem 1. - Aplikuj k-means clustering na normalizovaný dataset.
- Extrahuj labely clusterů a ulož je jako objekt
cluster_labels.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import KMeans
from ____.____ import ____
# Initialize KMeans
kmeans = ____(____, ____)
# Fit k-means clustering on the normalized data set
____.____(____)
# Extract cluster labels
cluster_labels = ____.____