K-means: Średnie szerokości sylwetki
Grupowanie hierarchiczne wskazuje 3 skupienia, natomiast metoda łokcia sugeruje 2. W tym ćwiczeniu użyj średnich szerokości sylwetki, aby sprawdzić, jaka wartość k jest „najlepsza".
To ćwiczenie jest częścią kursu
Analiza skupień w R
Instrukcje do ćwiczenia
- Użyj
map_dbl(), aby uruchomićpam()na danychoesdla wartości k od 2 do 10, a następnie wyodrębnij z każdego modelu wartość średniej szerokości sylwetki:model$silinfo$avg.width. Wynikowy wektor zapisz jakosil_width. - Zbuduj nową ramkę danych
sil_dfzawierającą wartości k oraz wektor średnich szerokości sylwetki. - Korzystając z wartości w
sil_df, stwórz wykres liniowy pokazujący zależność między k a średnią szerokością sylwetki.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Use map_dbl to run many models with varying value of k
sil_width <- map_dbl(2:10, function(k){
model <- pam(___, k = ___)
model$silinfo$avg.width
})
# Generate a data frame containing both k and sil_width
sil_df <- data.frame(
k = ___,
sil_width = ___
)
# Plot the relationship between k and sil_width
ggplot(___, aes(x = ___, y = ___)) +
geom_line() +
scale_x_continuous(breaks = 2:10)