Dữ liệu ngầm định vs. dữ liệu tường minh
Như đã đề cập trong video bài tập, phản hồi dùng trong hệ thống gợi ý có thể là tường minh hoặc ngầm định.
Bộ dữ liệu listening_history_df đã được nạp sẵn cho bạn.
Bộ dữ liệu này chứa các cột xác định người dùng, bài hát họ nghe, cùng với:
Skipped Track: Cột Boolean ghi nhận người dùng có bỏ qua bài hát hay nghe đến cuối.Rating: Điểm người dùng chấm cho bài hát theo thang 10.
Trong bài tập này, bạn sẽ khám phá dữ liệu và từ đó xác định cột nào phản ánh rõ nhất phản hồi tường minh và phản hồi ngầm định.
Bài tập này là một phần của khóa học
Xây dựng Recommendation Engine bằng Python
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Inspect the listening_history_df DataFrame
print(listening_history_df.____())
# Calculate the number of unique values
print(listening_history_df[['Rating', 'Skipped Track']].____())
# Display a histogram of the values in the Rating column
listening_history_df['Rating'].____()
plt.show()