Виконання напівз'єднання (semi join)
Деякі треки, що принесли найбільший дохід, — це записи з телешоу або інший немузичний аудіоконтент. У вас є таблиця інвойсів з позиціями, які генерують найбільший дохід. Крім того, є таблиця немузичних треків зі стримінгового сервісу. У цій вправі ви виконаєте напівз'єднання, щоб знайти немузичні треки з найбільшим доходом.
Таблиці non_mus_tcks, top_invoices і genres уже завантажено для вас.
Ця вправа є частиною курсу
Об'єднання даних у pandas
Інструкції до вправи
- Об'єднайте
non_mus_tcksіtop_invoicesзаtid, використовуючи inner join. Збережіть результат уtracks_invoices. - Використайте
.isin(), щоб відібрати рядки зnon_mus_tcks, деtidвходить до стовпцяtidуtracks_invoices. Збережіть результат уtop_tracks. - Згрупуйте
top_tracksзаgidі порахуйте рядкиtid. Збережіть результат уcnt_by_gid. - Об'єднайте
cnt_by_gidіз таблицеюgenresзаgidі виведіть результат.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Merge the non_mus_tcks and top_invoices tables on tid
tracks_invoices = ____.merge(____)
# Use .isin() to subset non_mus_tcks to rows with tid in tracks_invoices
top_tracks = _____[non_mus_tcks['tid'].isin(____)]
# Group the top_tracks by gid and count the tid rows
cnt_by_gid = top_tracks.groupby(['gid'], as_index=False).agg({'tid':____})
# Merge the genres table to cnt_by_gid on gid and print
print(____)