읽을 시간이에요, Katniss!
이제 곧 오늘 업무를 마칠 시간이네요. 그전에 재미로 간단한 분석을 해 보려고 해요. 이번에는 《헝거 게임》 시리즈의 다른 도서 데이터셋을 분석해 보겠습니다.
형태를 바꾸기 전에 books_hunger 데이터셋을 살펴봤는데, 뭔가 이상했어요. DataFrame의 인덱스에 책 제목이 들어가 있었습니다. 이 상태로는 형태를 바꿀 수 없다는 걸 알고 계시죠. 그대로 변환하면 중요한 데이터인 제목을 잃게 되니, DataFrame을 변환하기 전에 몇 가지를 수정해야 합니다.
books_hunger 데이터셋이 제공되어 있습니다. 이 데이터셋에는 각 책의 title, language, publication date, publication number, page number 정보가 들어 있습니다.
이 연습은 강의의 일부입니다
pandas로 데이터 재구조화하기
연습 안내
books_hungerDataFrame의 인덱스를 삭제하지 않고 재설정하세요.books_hunger를 와이드 형식에서 롱 형식으로 변환하세요.title과language열을 고유 인덱스로 사용하세요.publication으로 시작하거나page로 시작하는 열들에서 만들어지는 새 변수를feature로 이름 붙이세요. 해당 열들은 공백으로 구분되어 있으며 끝이 단어로 끝납니다.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)
# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____,
____=____,
____=____,
____=____,
____=____,
____=____)
# Print publication_features
print(publication_features)