Моделирование набора данных о НЛО, часть 1
В этом упражнении вы построите модель метода k ближайших соседей, чтобы предсказать, в какой стране было зафиксировано наблюдение НЛО. Набор X содержит столбец с логарифмически нормализованными секундами, столбцы с унитарным кодированием типа наблюдения, а также месяц и год события. Метки y — это закодированный столбец страны, где 1 соответствует "us", а 0 — "ca".
Это упражнение является частью курса
Предобработка данных для машинного обучения на Python
Инструкции к упражнению
- Выведите на экран атрибут
.columnsнабораX. - Разделите наборы
Xиyтак, чтобы распределение классов меток было одинаковым в обучающей и тестовой выборках; используйтеrandom_stateравным42. - Обучите модель
knnна обучающих данных. - Выведите точность модели
knnна тестовой выборке.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Take a look at the features in the X set of data
print(____)
# Split the X and y sets
X_train, X_test, y_train, y_test = ____
# Fit knn to the training sets
knn.____
# Print the score of knn on the test sets
print(____)