Моделювання набору даних про НЛО, частина 1
У цій вправі ви збудуєте модель k найближчих сусідів, щоб передбачити, у якій країні сталося спостереження НЛО. Набір X містить логнормалізовану колонку секунд, one-hot закодовані колонки типу, а також місяць і рік, коли відбулося спостереження. Мітки y — це закодована колонка країни, де 1 — це "us", а 0 — "ca".
Ця вправа є частиною курсу
Передобробка для машинного навчання в Python
Інструкції до вправи
- Виведіть
.columnsнаборуX. - Розбийте набори
Xіy, забезпечивши, щоб розподіл класів міток був однаковим у тренувальному та тестовому наборах, і використовуйтеrandom_state42. - Навчіть
knnна тренувальних даних. - Виведіть точність на тестовому наборі для моделі
knn.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Take a look at the features in the X set of data
print(____)
# Split the X and y sets
X_train, X_test, y_train, y_test = ____
# Fit knn to the training sets
knn.____
# Print the score of knn on the test sets
print(____)