ПочатиПочніть безкоштовно

Кластеризація даних про риб

Тепер ви використаєте свій конвеєр стандартизації та кластеризації з попередньої вправи, щоб згрупувати риб за їхніми вимірюваннями, а потім створите перехресну таблицю для порівняння міток кластерів із видами риб.

Як і раніше, samples — це 2D-масив вимірювань риб. Ваш конвеєр доступний як pipeline, а вид кожного зразка риби задано в списку species.

Ця вправа є частиною курсу

Наглядове навчання в Python

Переглянути курс

Інструкції до вправи

  • Імпортуйте pandas як pd.
  • Навчіть конвеєр на вимірюваннях риб samples за допомогою .fit().
  • Отримайте мітки кластерів для samples, використавши метод .predict() обʼєкта pipeline.
  • За допомогою pd.DataFrame() створіть датафрейм df із двома стовпцями 'labels' і 'species', використовуючи відповідно labels і species як значення стовпців.
  • За допомогою pd.crosstab() створіть перехресну таблицю ct для df['labels'] і df['species'].

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Import pandas
import pandas as pd

# Fit the pipeline to samples
____

# Calculate the cluster labels: labels
labels = ____

# Create a DataFrame with labels and species as columns: df
df = ____

# Create crosstab: ct
ct = ____

# Display ct
print(ct)
Редагувати та запускати код