НачатьНачать бесплатно

Вложенные данные о фильмах

У вас давно хранится набор данных movies с информацией о различных фильмах, и вы хотите его проанализировать. Однако данные представлены в виде вложенного JSON-формата.

Чтобы загрузить их в DataFrame, воспользуйтесь функцией, которую вы только что изучили. Затем преобразуйте полученный DataFrame, чтобы с ним было удобнее работать.

Полуструктурированный JSON с именем movies уже доступен для вас. Обязательно изучите его в консоли!

Это упражнение является частью курса

Преобразование данных с помощью pandas

Посмотреть курс

Инструкции к упражнению

  • Импортируйте функцию json_normalize() из pandas.
  • Нормализуйте JSON, содержащийся в movies. В качестве разделителя для имён, сформированных из вложенных записей, используйте символ подчёркивания.
  • Преобразуйте полученный DataFrame movies_norm из широкого формата в длинный, используя столбцы director и producer в качестве уникальных индексов. Назовите новую переменную, созданную из столбцов, movies, начиная с features, разделённой символом подчёркивания, с суффиксом, содержащим слова.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Import the json_normalize function
____

# Normalize movies and separate the new columns with an underscore 
movies_norm = ____(____, sep=____)

# Reshape using director and producer as index, create movies from column starting from features
movies_long = pd.____(____, stubnames=____, 
                      i=____, j=____, 
                      sep=____, suffix=____)

# Print movies_long
print(movies_long)
Редактировать и запускать код