E timpul să citești, Katniss!
Ziua de lucru este aproape gata să se încheie. Înainte de asta, vrei să faci o mică analiză de plăcere. Vei analiza un alt set de date cu cărți, de data aceasta din seria Hunger Games.
Ai explorat setul de date books_hunger înainte de a-l remodela, dar ceva nu era în regulă. Indexul DataFrame-ului conține titlurile cărților. Știi că nu poți remodela datele în acest format – ai pierde informații valoroase, și anume titlul – așa că va trebui să faci câteva modificări înainte de a transforma DataFrame-ul.
Setul de date books_hunger este disponibil. Conține coloana title și date despre language, publication date, publication number și page number pentru fiecare carte.
Acest exercițiu face parte din cursul
Restructurarea datelor cu pandas
Instrucțiuni pentru exercițiu
- Modifică DataFrame-ul
books_hungerprin resetarea indexului fără a-l elimina. - Remodelează
books_hungerdin format wide în format long. Folosește coloaneletitleșilanguageca indecși unici. Denumeștefeaturenoua variabilă creată din coloanele care încep cupublicationșipage. Aceste coloane sunt separate printr-un spațiu și se termină cu un cuvânt.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)
# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____,
____=____,
____=____,
____=____,
____=____,
____=____)
# Print publication_features
print(publication_features)