Кластеризація даних про риб
Тепер ви використаєте свій конвеєр стандартизації та кластеризації з попередньої вправи, щоб згрупувати риб за їхніми вимірюваннями, а потім створите перехресну таблицю для порівняння міток кластерів із видами риб.
Як і раніше, samples — це 2D-масив вимірювань риб. Ваш конвеєр доступний як pipeline, а вид кожного зразка риби задано в списку species.
Ця вправа є частиною курсу
Наглядове навчання в Python
Інструкції до вправи
- Імпортуйте
pandasякpd. - Навчіть конвеєр на вимірюваннях риб
samplesза допомогою.fit(). - Отримайте мітки кластерів для
samples, використавши метод.predict()обʼєктаpipeline. - За допомогою
pd.DataFrame()створіть датафреймdfіз двома стовпцями'labels'і'species', використовуючи відповідноlabelsіspeciesяк значення стовпців. - За допомогою
pd.crosstab()створіть перехресну таблицюctдляdf['labels']іdf['species'].
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Import pandas
import pandas as pd
# Fit the pipeline to samples
____
# Calculate the cluster labels: labels
labels = ____
# Create a DataFrame with labels and species as columns: df
df = ____
# Create crosstab: ct
ct = ____
# Display ct
print(ct)