EmpezarEmpieza gratis

Tipos de datos de valoraciones

Markus ve muchas películas, incluidas documentales, de superhéroes, clásicos y dramas. Basándote en tu experiencia previa con Spark, utiliza el dataframe markus_ratings, que contiene datos sobre cuántas veces ha visto Markus películas de varios géneros, y piensa si se trata de valoraciones implícitas o explícitas. Usa el método groupBy() para determinar qué género tiene la valoración más alta, lo que probablemente influirá en las recomendaciones que ALS generaría para Markus.

Este ejercicio forma parte del curso

Creación de motores de recomendación con PySpark

Ver curso

Instrucciones del ejercicio

  • Usa el método groupBy() para agrupar el dataframe markus_ratings por "Genre".
  • Aplica el método .sum() para obtener el número total de películas vistas por cada género.
  • Asegúrate de añadir el método .show() al final para ver los recuentos.

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

# Group the data by "Genre"
markus_ratings.____("____").____().____()
Editar y ejecutar código