ПочатиПочніть безкоштовно

Моделювання набору даних про НЛО, частина 1

У цій вправі ви збудуєте модель k найближчих сусідів, щоб передбачити, у якій країні сталося спостереження НЛО. Набір X містить логнормалізовану колонку секунд, one-hot закодовані колонки типу, а також місяць і рік, коли відбулося спостереження. Мітки y — це закодована колонка країни, де 1 — це "us", а 0"ca".

Ця вправа є частиною курсу

Передобробка для машинного навчання в Python

Переглянути курс

Інструкції до вправи

  • Виведіть .columns набору X.
  • Розбийте набори X і y, забезпечивши, щоб розподіл класів міток був однаковим у тренувальному та тестовому наборах, і використовуйте random_state 42.
  • Навчіть knn на тренувальних даних.
  • Виведіть точність на тестовому наборі для моделі knn.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Take a look at the features in the X set of data
print(____)

# Split the X and y sets
X_train, X_test, y_train, y_test = ____

# Fit knn to the training sets
knn.____

# Print the score of knn on the test sets
print(____)
Редагувати та запускати код