НачатьНачать бесплатно

Разбиение данных на подмножества

Напомним, что компания планирует расширить бизнес и вывести Hoppiness на общенациональный рынок. Поэтому модель должна хорошо работать и на данных из новых магазинов. Один из способов оценить, как модель поведёт себя на новых данных, — обучить её на одной части данных, а затем проверить на оставшейся.

Обучающий набор данных формируется путём исключения последней покупки, зафиксированной для каждого покупателя. Для этого можно применить функцию subset() к choice.data и отобрать все наблюдения, в которых индикаторная переменная LASTPURCHASE равна 0. Аналогичным образом тестовый набор данных формируется путём отбора всех наблюдений, где LASTPURCHASE равна 1.

Это упражнение является частью курса

Построение моделей отклика в R

Посмотреть курс

Инструкции к упражнению

  • Исключите последнюю покупку, чтобы создать обучающий набор данных. Используйте функцию subset() на choice.data. Укажите LASTPURCHASE == 0 в качестве аргумента subset. Сохраните результат в переменную train.data.
  • Создайте тестовый набор данных с помощью функции subset() на choice.data. Укажите LASTPURCHASE == 1 в качестве аргумента subset. Сохраните результат в переменную test.data.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Create the training data


# Create the test data
Редактировать и запускать код