시작하기무료로 시작하기

여러 스프레드시트 다루기

사람이 읽기 편하도록 만든 워크북(기계 처리용이 아님)은 하나의 주제에 대한 데이터를 여러 시트에 나눠 저장하는 경우가 있어요. 예를 들어, 어떤 파일은 기업이 운영한 각 지역이나 연도별로 거래 내역을 다른 시트에 보관할 수 있습니다.

FreeCodeCamp New Developer Survey 파일도 비슷하게 구성되어 있으며, 서로 다른 연도의 응답 샘플이 각기 다른 시트에 들어 있어요. 이번 과제는 이들을 하나의 데이터프레임으로 합쳐서 분석할 수 있게 만드는 것입니다.

pandaspd로 임포트되어 있습니다. 모든 시트는 정렬된 딕셔너리 responses에 읽어 들였고, 시트 이름이 키, 데이터프레임이 값이에요. 따라서 values() 메서드로 데이터프레임들을 가져올 수 있습니다.

이 연습은 강의의 일부입니다

pandas로 빠르고 간편한 데이터 적재

강의 보기

연습 안내

  • 빈 데이터프레임 all_responses를 만드세요.
  • responses 딕셔너리의 값들을 순회하는 for 반복문을 설정하세요.
  • 각 데이터프레임을 all_responses에 이어 붙이고, 결과를 동일한 변수명에 다시 할당하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Create an empty dataframe
all_responses = ____

# Set up for loop to iterate through values in responses
for df in ____:
  # Print the number of rows being added
  print("Adding {} rows".format(df.shape[0]))
  # Concatenate all_responses and df, assign result
  all_responses = pd.concat(____)

# Graph employment statuses in sample
counts = all_responses.groupby("EmploymentStatus").EmploymentStatus.count()
counts.plot.barh()
plt.show()
코드 편집 및 실행