Вложенные данные о фильмах
У вас давно хранится набор данных movies с информацией о различных фильмах, и вы хотите его проанализировать. Однако данные представлены в виде вложенного JSON-формата.
Чтобы загрузить их в DataFrame, воспользуйтесь функцией, которую вы только что изучили. Затем преобразуйте полученный DataFrame, чтобы с ним было удобнее работать.
Полуструктурированный JSON с именем movies уже доступен для вас. Обязательно изучите его в консоли!
Это упражнение является частью курса
Преобразование данных с помощью pandas
Инструкции к упражнению
- Импортируйте функцию
json_normalize()изpandas. - Нормализуйте JSON, содержащийся в
movies. В качестве разделителя для имён, сформированных из вложенных записей, используйте символ подчёркивания. - Преобразуйте полученный DataFrame
movies_normиз широкого формата в длинный, используя столбцыdirectorиproducerв качестве уникальных индексов. Назовите новую переменную, созданную из столбцов,movies, начиная сfeatures, разделённой символом подчёркивания, с суффиксом, содержащим слова.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Import the json_normalize function
____
# Normalize movies and separate the new columns with an underscore
movies_norm = ____(____, sep=____)
# Reshape using director and producer as index, create movies from column starting from features
movies_long = pd.____(____, stubnames=____,
i=____, j=____,
sep=____, suffix=____)
# Print movies_long
print(movies_long)