Začněte nyníZačněte zdarma

Elementární, drahý Watsone!

Je pátek a práce na knižním projektu se blíží ke konci. V posledním úkolu budeš analyzovat data o knihách Arthura Conana Doyla.

Zjistíš, že dataset books_sh potřebuje přeformátovat. Všimneš si, že některé sloupce lze seskupit podle společného prefixu. Určíš sloupce, které slouží jako jedinečné identifikátory. Některé z nich ale obsahují řetězce, které je potřeba upravit ještě před samotnou transformací z širokého na dlouhý formát. Rozhodneš se, že část řetězců je nutné rozdělit, aby byl DataFrame přehlednější.

K dispozici máš dataset books_sh, který obsahuje title a údaje o version, number_pages a number_ratings každé knihy.

Toto cvičení je součástí kurzu

Přetváření dat s pandas

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Split main_title by a colon and assign it to two columns named title and subtitle 
books_sh[['title', 'subtitle']] = ____[____].____.____(____, ____=____)

# Print books_sh
print(books_sh)
Upravit a spustit kód