Разбиение данных на подмножества
Напомним, что компания планирует расширить бизнес и вывести Hoppiness на общенациональный рынок. Поэтому модель должна хорошо работать и на данных из новых магазинов. Один из способов оценить, как модель поведёт себя на новых данных, — обучить её на одной части данных, а затем проверить на оставшейся.
Обучающий набор данных формируется путём исключения последней покупки, зафиксированной для каждого покупателя. Для этого можно применить функцию subset() к choice.data и отобрать все наблюдения, в которых индикаторная переменная LASTPURCHASE равна 0. Аналогичным образом тестовый набор данных формируется путём отбора всех наблюдений, где LASTPURCHASE равна 1.
Это упражнение является частью курса
Построение моделей отклика в R
Инструкции к упражнению
- Исключите последнюю покупку, чтобы создать обучающий набор данных. Используйте функцию
subset()наchoice.data. УкажитеLASTPURCHASE == 0в качестве аргументаsubset. Сохраните результат в переменнуюtrain.data. - Создайте тестовый набор данных с помощью функции
subset()наchoice.data. УкажитеLASTPURCHASE == 1в качестве аргументаsubset. Сохраните результат в переменнуюtest.data.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Create the training data
# Create the test data