Čas na čtení, Katniss!
Pracovní den se chýlí ke konci. Než ale skončíš, čeká tě jedno analýza pro zábavu – podíváš se na další knižní dataset, tentokrát se sérií Hunger Games.
Dataset books_hunger jsi prozkoumal/a ještě před jeho přetvarováním, ale něco nebylo v pořádku. Index DataFrame obsahuje názvy knih. V tomto formátu ho přetvarovat nelze – přišel/přišla bys o důležitá data, konkrétně o názvy. Před transformací je proto potřeba pár věcí upravit.
Dataset books_hunger máš k dispozici. Obsahuje sloupec title a data o language, publication date, publication number a page number každé knihy.
Toto cvičení je součástí kurzu
Přetváření dat s pandas
Pokyny k cvičení
- Uprav DataFrame
books_hungertak, že resetuješ index bez jeho odstranění. - Přetvaruj
books_hungerz širokého formátu na dlouhý. Jako jedinečné indexy použij sloupcetitlealanguage. Novou proměnnou vzniklou ze sloupců začínajících napublicationapagepojmenujfeature. Tyto sloupce jsou odděleny mezerou a končí slovem.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)
# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____,
____=____,
____=____,
____=____,
____=____,
____=____)
# Print publication_features
print(publication_features)