ПочатиПочніть безкоштовно

Типи даних оцінок

Марк уотчить багато фільмів: документальні, про супергероїв, класичні та драми. Спираючись на ваш попередній досвід зі Spark, використайте датафрейм markus_ratings, який містить дані про те, скільки разів Марк переглядав фільми різних жанрів, і поміркуйте, чи це неявні чи явні оцінки. Застосуйте метод groupBy(), щоб визначити, який жанр має найвищий показник, що, ймовірно, вплине на те, які рекомендації ALS згенерує для Марка.

Ця вправа є частиною курсу

Створення рушіїв рекомендацій у PySpark

Переглянути курс

Інструкції до вправи

  • Використайте метод groupBy(), щоб згрупувати датафрейм markus_ratings за "Genre".
  • Застосуйте метод .sum(), щоб отримати загальну кількість переглянутих фільмів для кожного жанру.
  • Обовʼязково додайте метод .show() наприкінці, щоб переглянути підрахунки.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Group the data by "Genre"
markus_ratings.____("____").____().____()
Редагувати та запускати код