Vnořená data o filmech
Máš na počítači dataset movies, který jsi zatím nestačil/a blíže prozkoumat – obsahuje data o různých filmech. Rád/a bys je analyzoval/a, ale zjistíš, že jsou ve vnořeném formátu JSON.
Pro načtení do DataFrame budeš muset použít funkci, kterou ses právě naučil/a. Poté výsledný DataFrame přetvaruješ do podoby, se kterou se bude snadněji pracovat.
Polostrukturovaný JSON s názvem movies máš k dispozici. Nezapomeň si ho prohlédnout v konzoli!
Toto cvičení je součástí kurzu
Přetváření dat s pandas
Pokyny k cvičení
- Importuj funkci
json_normalize()zpandas. - Normalizuj JSON obsažený v
movies. Názvy vygenerované z vnořených záznamů odděluj podtržítkem. - Přetvoř výsledný DataFrame
movies_normz širokého do dlouhého formátu – jako unikátní indexy použij sloupcedirectoraproducer. Novou proměnnou vytvořenou ze sloupců pojmenujmovies, začínající hodnotoufeatures, oddělenou podtržítkem s příponou obsahující slova.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import the json_normalize function
____
# Normalize movies and separate the new columns with an underscore
movies_norm = ____(____, sep=____)
# Reshape using director and producer as index, create movies from column starting from features
movies_long = pd.____(____, stubnames=____,
i=____, j=____,
sep=____, suffix=____)
# Print movies_long
print(movies_long)