НачатьНачать бесплатно

Выполнение полусоединения

Некоторые треки с наибольшим доходом относятся к саундтрекам из телешоу или являются другими немузыкальными аудиозаписями. У вас есть таблица счетов-фактур с позициями, приносящими наибольший доход, а также таблица немузыкальных треков стримингового сервиса. В этом упражнении вы воспользуетесь полусоединением, чтобы найти немузыкальные треки с наибольшим доходом.

Таблицы non_mus_tcks, top_invoices и genres уже загружены.

Это упражнение является частью курса

Объединение данных с помощью pandas

Посмотреть курс

Инструкции к упражнению

  • Объедините non_mus_tcks и top_invoices по столбцу tid с помощью внутреннего соединения. Сохраните результат в переменную tracks_invoices.
  • Используйте .isin(), чтобы отфильтровать строки non_mus_tcks, у которых значение tid входит в столбец tid таблицы tracks_invoices. Сохраните результат в переменную top_tracks.
  • Сгруппируйте top_tracks по столбцу gid и подсчитайте количество строк по tid. Сохраните результат в переменную cnt_by_gid.
  • Объедините cnt_by_gid с таблицей genres по столбцу gid и выведите результат на экран.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Merge the non_mus_tcks and top_invoices tables on tid
tracks_invoices = ____.merge(____)

# Use .isin() to subset non_mus_tcks to rows with tid in tracks_invoices
top_tracks = _____[non_mus_tcks['tid'].isin(____)]

# Group the top_tracks by gid and count the tid rows
cnt_by_gid = top_tracks.groupby(['gid'], as_index=False).agg({'tid':____})

# Merge the genres table to cnt_by_gid on gid and print
print(____)
Редактировать и запускать код