Začněte nyníZačněte zdarma

Zpět k velkoobchodním datům: průzkum

Z předchozí analýzy vyplynulo, že k = 2 dosahuje nejvyšší průměrné šířky silhouette. V tomto cvičení budeš pokračovat v analýze dat velkoobchodních zákazníků – vytvoříš a prozkoumáš model k-means se 2 shluky.

Toto cvičení je součástí kurzu

Cluster Analysis v R

Zobrazit kurz

Pokyny k cvičení

  • Vytvoř model k-means s názvem model_customers pro data customers_spend pomocí funkce kmeans() s parametrem centers = 2.
  • Extrahuj vektor přiřazení shluků z modelu model_customers$cluster a ulož ho do proměnné clust_customers.
  • Přidej přiřazení shluků jako sloupec cluster do datového rámce customers_spend a výsledek ulož do nového datového rámce s názvem segment_customers.
  • Zjisti velikost každého shluku pomocí funkce count().

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

set.seed(42)

# Build a k-means model for the customers_spend with a k of 2
model_customers <- ___

# Extract the vector of cluster assignments from the model
clust_customers <- ___

# Build the segment_customers data frame
segment_customers <- mutate(___, cluster = ___)

# Calculate the size of each cluster
count(___, ___)

# Calculate the mean for each category
segment_customers %>% 
  group_by(cluster) %>% 
  summarise_all(list(mean))
Upravit a spustit kód