Elementární, drahý Watsone!
Je pátek a práce na knižním projektu se blíží ke konci. V posledním úkolu budeš analyzovat data o knihách Arthura Conana Doyla.
Zjistíš, že dataset books_sh potřebuje přeformátovat. Všimneš si, že některé sloupce lze seskupit podle společného prefixu. Určíš sloupce, které slouží jako jedinečné identifikátory. Některé z nich ale obsahují řetězce, které je potřeba upravit ještě před samotnou transformací z širokého na dlouhý formát. Rozhodneš se, že část řetězců je nutné rozdělit, aby byl DataFrame přehlednější.
K dispozici máš dataset books_sh, který obsahuje title a údaje o version, number_pages a number_ratings každé knihy.
Toto cvičení je součástí kurzu
Přetváření dat s pandas
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Split main_title by a colon and assign it to two columns named title and subtitle
books_sh[['title', 'subtitle']] = ____[____].____.____(____, ____=____)
# Print books_sh
print(books_sh)