Tipos de datos de valoraciones
Markus ve muchas películas, incluidas documentales, de superhéroes, clásicos y dramas. Basándote en tu experiencia previa con Spark, utiliza el dataframe markus_ratings, que contiene datos sobre cuántas veces ha visto Markus películas de varios géneros, y piensa si se trata de valoraciones implícitas o explícitas. Usa el método groupBy() para determinar qué género tiene la valoración más alta, lo que probablemente influirá en las recomendaciones que ALS generaría para Markus.
Este ejercicio forma parte del curso
Creación de motores de recomendación con PySpark
Instrucciones del ejercicio
- Usa el método
groupBy()para agrupar el dataframemarkus_ratingspor"Genre". - Aplica el método
.sum()para obtener el número total de películas vistas por cada género. - Asegúrate de añadir el método
.show()al final para ver los recuentos.
ejercicio interactivo práctico
Prueba este ejercicio completando este código de ejemplo.
# Group the data by "Genre"
markus_ratings.____("____").____().____()