НачатьНачать бесплатно

Моделирование набора данных о НЛО, часть 1

В этом упражнении вы построите модель метода k ближайших соседей, чтобы предсказать, в какой стране было зафиксировано наблюдение НЛО. Набор X содержит столбец с логарифмически нормализованными секундами, столбцы с унитарным кодированием типа наблюдения, а также месяц и год события. Метки y — это закодированный столбец страны, где 1 соответствует "us", а 0"ca".

Это упражнение является частью курса

Предобработка данных для машинного обучения на Python

Посмотреть курс

Инструкции к упражнению

  • Выведите на экран атрибут .columns набора X.
  • Разделите наборы X и y так, чтобы распределение классов меток было одинаковым в обучающей и тестовой выборках; используйте random_state равным 42.
  • Обучите модель knn на обучающих данных.
  • Выведите точность модели knn на тестовой выборке.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Take a look at the features in the X set of data
print(____)

# Split the X and y sets
X_train, X_test, y_train, y_test = ____

# Fit knn to the training sets
knn.____

# Print the score of knn on the test sets
print(____)
Редактировать и запускать код