Выполнение полусоединения
Некоторые треки с наибольшим доходом относятся к саундтрекам из телешоу или являются другими немузыкальными аудиозаписями. У вас есть таблица счетов-фактур с позициями, приносящими наибольший доход, а также таблица немузыкальных треков стримингового сервиса. В этом упражнении вы воспользуетесь полусоединением, чтобы найти немузыкальные треки с наибольшим доходом.
Таблицы non_mus_tcks, top_invoices и genres уже загружены.
Это упражнение является частью курса
Объединение данных с помощью pandas
Инструкции к упражнению
- Объедините
non_mus_tcksиtop_invoicesпо столбцуtidс помощью внутреннего соединения. Сохраните результат в переменнуюtracks_invoices. - Используйте
.isin(), чтобы отфильтровать строкиnon_mus_tcks, у которых значениеtidвходит в столбецtidтаблицыtracks_invoices. Сохраните результат в переменнуюtop_tracks. - Сгруппируйте
top_tracksпо столбцуgidи подсчитайте количество строк поtid. Сохраните результат в переменнуюcnt_by_gid. - Объедините
cnt_by_gidс таблицейgenresпо столбцуgidи выведите результат на экран.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Merge the non_mus_tcks and top_invoices tables on tid
tracks_invoices = ____.merge(____)
# Use .isin() to subset non_mus_tcks to rows with tid in tracks_invoices
top_tracks = _____[non_mus_tcks['tid'].isin(____)]
# Group the top_tracks by gid and count the tid rows
cnt_by_gid = top_tracks.groupby(['gid'], as_index=False).agg({'tid':____})
# Merge the genres table to cnt_by_gid on gid and print
print(____)