НачатьНачать бесплатно

Время читать, Китнисс!

Рабочий день подходит к концу, но напоследок вы хотите провести небольшой анализ для себя. На этот раз вы будете работать с набором данных о серии книг «Голодные игры».

Вы уже изучали набор данных books_hunger до его преобразования, но заметили кое-что странное: индекс DataFrame содержит названия книг. В таком формате преобразовать данные не получится — вы потеряете важную информацию, а именно названия. Поэтому перед трансформацией нужно внести изменения.

Набор данных books_hunger уже доступен. Он содержит столбец title, а также данные о language, publication date, publication number и page number для каждой книги.

Это упражнение является частью курса

Преобразование данных с помощью pandas

Посмотреть курс

Инструкции к упражнению

  • Измените DataFrame books_hunger, сбросив индекс без его удаления.
  • Преобразуйте books_hunger из широкого формата в длинный. Используйте столбцы title и language в качестве уникальных индексов. Назовите feature новую переменную, созданную из столбцов, начинающихся с publication и page. Эти столбцы разделены пробелом и заканчиваются словом.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)

# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____)

# Print publication_features
print(publication_features)
Редактировать и запускать код