Začněte nyníZačněte zdarma

Vnořená data o filmech

Máš na počítači dataset movies, který jsi zatím nestačil/a blíže prozkoumat – obsahuje data o různých filmech. Rád/a bys je analyzoval/a, ale zjistíš, že jsou ve vnořeném formátu JSON.

Pro načtení do DataFrame budeš muset použít funkci, kterou ses právě naučil/a. Poté výsledný DataFrame přetvaruješ do podoby, se kterou se bude snadněji pracovat.

Polostrukturovaný JSON s názvem movies máš k dispozici. Nezapomeň si ho prohlédnout v konzoli!

Toto cvičení je součástí kurzu

Přetváření dat s pandas

Zobrazit kurz

Pokyny k cvičení

  • Importuj funkci json_normalize() z pandas.
  • Normalizuj JSON obsažený v movies. Názvy vygenerované z vnořených záznamů odděluj podtržítkem.
  • Přetvoř výsledný DataFrame movies_norm z širokého do dlouhého formátu – jako unikátní indexy použij sloupce director a producer. Novou proměnnou vytvořenou ze sloupců pojmenuj movies, začínající hodnotou features, oddělenou podtržítkem s příponou obsahující slova.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import the json_normalize function
____

# Normalize movies and separate the new columns with an underscore 
movies_norm = ____(____, sep=____)

# Reshape using director and producer as index, create movies from column starting from features
movies_long = pd.____(____, stubnames=____, 
                      i=____, j=____, 
                      sep=____, suffix=____)

# Print movies_long
print(movies_long)
Upravit a spustit kód