Час читати, Кетніс!
Робочий день майже завершився. Але спершу ви хочете зробити невеличкий аналіз для задоволення. Ви проаналізуєте ще один набір даних про книжки — цього разу серію The Hunger Games.
Ви вже переглядали набір даних books_hunger до перетворення його форми, але щось було не так. Індекс датафрейму містить назви книжок. Ви знаєте, що в такому вигляді його не можна переформатовувати. Якщо це зробити, ви втратите важливі дані — назву, тож перед трансформуванням датафрейму потрібно внести зміни.
Набір даних books_hunger доступний для вас. Він містить title та дані про language, publication date, publication number і page number для кожної книжки.
Ця вправа є частиною курсу
Переформатування даних у pandas
Інструкції до вправи
- Змініть датафрейм
books_hunger, скинувши індекс без його видалення. - Перетворіть
books_hungerз широкого у довгий формат. Використайте стовпціtitleіlanguageяк унікальні індекси. Назвітьfeatureнову змінну, утворену зі стовпців, що починаються зpublicationіpage. Ці стовпці розділені пробілом і закінчуються словом.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)
# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____,
____=____,
____=____,
____=____,
____=____,
____=____)
# Print publication_features
print(publication_features)