1. Learn
  2. /
  3. Курси
  4. /
  5. Кероване навчання в R: регресія

Connected

Вправа

Навчіть модель xgboost для прокату велосипедів і зробіть прогноз

У цій вправі ви навчите модель градієнтного бустингу за допомогою xgboost() для прогнозування кількості велосипедів, орендованих за годину, залежно від погоди, типу та часу доби. Ви навчатимете модель на даних за липень і робитимете прогнози на даних за серпень.

Датафрейми bikesJuly, bikesJuly.treat, bikesAugust і bikesAugust.treat уже завантажені. Пам'ятайте, що дані після vtreat більше не містять стовпця з цільовою змінною, тож її потрібно брати з оригінальних даних (стовпець cnt).

Для зручності доступне значення кількості дерев ntrees з попередньої вправи.

Аргументи xgboost() (docs) подібні до аргументів xgb.cv().

Інструкції

100 XP
  • Заповніть пропуски, щоб запустити xgboost() на липневих даних.
    • Використайте as.matrix(), щоб перетворити оброблений vtreat датафрейм на матрицю.
    • Мета (objective) має бути "reg:squarederror".
    • Використайте ntrees раундів.
    • Задайте eta рівним 0.75, max_depth — 5, а verbose — FALSE (тихий режим).
  • Тепер викличте predict() на bikesAugust.treat, щоб спрогнозувати кількість оренд у серпні.
    • Використайте as.matrix(), щоб перетворити тестові дані після vtreat на матрицю.
    • Додайте прогнози до bikesAugust як стовпець pred.
  • Заповніть пропуски, щоб побудувати графік фактичних значень прокату проти прогнозів (прогнози по осі x).
    • Чи бачите ви можливу проблему з прогнозами?