스프레드시트의 일부만 불러오기
사람이 읽기 좋게 만든 스프레드시트에는 표가 여러 개 있는 경우가 많아요. 예를 들어, 한 소규모 업체가 하나의 시트에 제품 유형별 표를 둔 재고 워크북을 유지할 수 있죠. 표 형식 데이터에도 메타데이터 성격의 헤더 행이 있을 수 있는데, 여기 있는 New Developer Survey 데이터가 그렇습니다. 메타데이터가 유용하긴 하지만, 데이터프레임에는 포함하고 싶지 않아요. read_excel()의 skiprows 키워드를 사용해 데이터만 가져오겠습니다. 또한 usecols에 전달할 문자열을 만들어, 향후 직무 목표에 관한 AD 열과 AW부터 BA까지의 열만 가져오세요.
pandas는 pd로 임포트되어 있습니다.
이 연습은 강의의 일부입니다
pandas로 빠르고 간편한 데이터 적재
연습 안내
pandas가AD열과AW부터BA까지의 범위를 로드하도록 지정하는 단일 문자열col_string을 만드세요.fcc_survey_headers.xlsx'를 로드하면서, 처음 두 행의 메타데이터를 건너뛰도록skiprows를 설정하고,col_string에 있는 열만 가져오도록usecols를 지정하세요.- 결과 데이터프레임에서 선택된 열 이름을 확인하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Create string of lettered columns to load
col_string = ____
# Load data with skiprows and usecols set
survey_responses = ____("fcc_survey_headers.xlsx",
____,
____)
# View the names of the columns selected
print(survey_responses.columns)