CommencezCommencez gratuitement

Regroupement K-means

Lors d'une entrevue en Machine Learning, on pourrait vous demander comment utiliser la sortie d'un regroupement K-means pour évaluer s'il s'agit du meilleur algorithme.

Dans cet exercice, vous allez pratiquer le regroupement K-means. En utilisant l'attribut .inertia_ pour comparer des modèles avec différents nombres de groupes, k, vous utiliserez ensuite ces informations pour évaluer le nombre de groupes dans le prochain exercice.

Rappelez-vous que la variable cible dans l'ensemble de données diabetes est progression.

Où vous en êtes dans le pipeline :

Pipeline de Machine learning

Cette activité fait partie du cours

S'exercer aux questions d'entrevue en Machine Learning avec Python

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Import module
from sklearn.cluster import KMeans

# Create feature matrix
X = diabetes.____("____", axis=1)

# Instantiate
kmeans = KMeans(n_clusters=2, random_state=123)

# Fit
fit = kmeans.____(____)

# Print inertia
print("Sum of squared distances for 2 clusters is", kmeans.inertia_)
Modifier et exécuter le code