ПочатиПочніть безкоштовно

Виконання напівз'єднання (semi join)

Деякі треки, що принесли найбільший дохід, — це записи з телешоу або інший немузичний аудіоконтент. У вас є таблиця інвойсів з позиціями, які генерують найбільший дохід. Крім того, є таблиця немузичних треків зі стримінгового сервісу. У цій вправі ви виконаєте напівз'єднання, щоб знайти немузичні треки з найбільшим доходом.

Таблиці non_mus_tcks, top_invoices і genres уже завантажено для вас.

Ця вправа є частиною курсу

Об'єднання даних у pandas

Переглянути курс

Інструкції до вправи

  • Об'єднайте non_mus_tcks і top_invoices за tid, використовуючи inner join. Збережіть результат у tracks_invoices.
  • Використайте .isin(), щоб відібрати рядки з non_mus_tcks, де tid входить до стовпця tid у tracks_invoices. Збережіть результат у top_tracks.
  • Згрупуйте top_tracks за gid і порахуйте рядки tid. Збережіть результат у cnt_by_gid.
  • Об'єднайте cnt_by_gid із таблицею genres за gid і виведіть результат.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Merge the non_mus_tcks and top_invoices tables on tid
tracks_invoices = ____.merge(____)

# Use .isin() to subset non_mus_tcks to rows with tid in tracks_invoices
top_tracks = _____[non_mus_tcks['tid'].isin(____)]

# Group the top_tracks by gid and count the tid rows
cnt_by_gid = top_tracks.groupby(['gid'], as_index=False).agg({'tid':____})

# Merge the genres table to cnt_by_gid on gid and print
print(____)
Редагувати та запускати код