Время читать, Китнисс!
Рабочий день подходит к концу, но напоследок вы хотите провести небольшой анализ для себя. На этот раз вы будете работать с набором данных о серии книг «Голодные игры».
Вы уже изучали набор данных books_hunger до его преобразования, но заметили кое-что странное: индекс DataFrame содержит названия книг. В таком формате преобразовать данные не получится — вы потеряете важную информацию, а именно названия. Поэтому перед трансформацией нужно внести изменения.
Набор данных books_hunger уже доступен. Он содержит столбец title, а также данные о language, publication date, publication number и page number для каждой книги.
Это упражнение является частью курса
Преобразование данных с помощью pandas
Инструкции к упражнению
- Измените DataFrame
books_hunger, сбросив индекс без его удаления. - Преобразуйте
books_hungerиз широкого формата в длинный. Используйте столбцыtitleиlanguageв качестве уникальных индексов. Назовитеfeatureновую переменную, созданную из столбцов, начинающихся сpublicationиpage. Эти столбцы разделены пробелом и заканчиваются словом.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)
# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____,
____=____,
____=____,
____=____,
____=____,
____=____)
# Print publication_features
print(publication_features)