여러 스프레드시트 다루기
사람이 읽기 편하도록 만든 워크북(기계 처리용이 아님)은 하나의 주제에 대한 데이터를 여러 시트에 나눠 저장하는 경우가 있어요. 예를 들어, 어떤 파일은 기업이 운영한 각 지역이나 연도별로 거래 내역을 다른 시트에 보관할 수 있습니다.
FreeCodeCamp New Developer Survey 파일도 비슷하게 구성되어 있으며, 서로 다른 연도의 응답 샘플이 각기 다른 시트에 들어 있어요. 이번 과제는 이들을 하나의 데이터프레임으로 합쳐서 분석할 수 있게 만드는 것입니다.
pandas는 pd로 임포트되어 있습니다. 모든 시트는 정렬된 딕셔너리 responses에 읽어 들였고, 시트 이름이 키, 데이터프레임이 값이에요. 따라서 values() 메서드로 데이터프레임들을 가져올 수 있습니다.
이 연습은 강의의 일부입니다
pandas로 빠르고 간편한 데이터 적재
연습 안내
- 빈 데이터프레임
all_responses를 만드세요. responses딕셔너리의 값들을 순회하는for반복문을 설정하세요.- 각 데이터프레임을
all_responses에 이어 붙이고, 결과를 동일한 변수명에 다시 할당하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Create an empty dataframe
all_responses = ____
# Set up for loop to iterate through values in responses
for df in ____:
# Print the number of rows being added
print("Adding {} rows".format(df.shape[0]))
# Concatenate all_responses and df, assign result
all_responses = pd.concat(____)
# Graph employment statuses in sample
counts = all_responses.groupby("EmploymentStatus").EmploymentStatus.count()
counts.plot.barh()
plt.show()