스프레드시트 가져오기 사용자 지정
이번에는 스프레드시트를 파싱하면서, 추가 인자를 사용해 행을 건너뛰고, 열 이름을 바꾸며, 특정 열만 선택해 보겠습니다.
스프레드시트 'battledeath.xlsx'는 이미 xls로 로드되어 있습니다.
앞서와 같이 parse() 메서드를 사용할 거예요. 하지만 이번에는
skiprows, names, usecols 인자를 추가로 지정합니다. 각각
행을 건너뛰고, 열 이름을 지정하며, 어떤 열을 파싱할지 선택하는 역할을 합니다.
이 인자들은 상황에 맞게 특정 행 번호, 문자열, 열 번호를 담은 리스트로 전달할 수 있습니다.
이 연습은 강의의 일부입니다
Python에서 데이터 가져오기 입문
연습 안내
- 첫 번째 시트를 인덱스로 파싱하세요. 이때 첫 번째 데이터 행을 건너뛰고,
names인자를 사용해 열 이름을'Country'와'AAM due to War (2002)'로 지정하세요.skiprows와names에 전달하는 값은 모두list타입이어야 합니다. - 두 번째 시트를 인덱스로 파싱하세요. 이때
usecols파라미터로 첫 번째 열만 파싱하고, 첫 번째 행을 건너뛰며, 열 이름을'Country'로 바꾸세요.usecols에 전달하는 인자 역시list타입이어야 합니다.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Parse the first sheet and rename the columns: df1
df1 = xls.parse(____, skiprows=____, names=____)
# Print the head of the DataFrame df1
print(df1.head())
# Parse the first column of the second sheet and rename the column: df2
df2 = xls.parse(____, usecols=____, skiprows=____, names=____)
# Print the head of the DataFrame df2
print(df2.head())