기업 상장 정보 탐색 및 정제
시가총액 기반 인덱스를 구성하기 위한 첫 단계로, 미국 3대 증권거래소인 NYSE, NASDAQ, AMEX의 통합 상장 정보를 활용합니다.
이번 연습 문제와 다음 연습 문제에서는 이 주식들의 시가총액 가중치를 계산합니다.
pandas는 pd로 이미 임포트되어 있으며, NYSE, NASDAQ, AMEX의 상장 정보가 담긴 listings 데이터셋도 로드되어 있습니다. 'Market Capitalization' 열의 단위는 이미 백만 달러(USD mn)로 설정되어 있습니다.
이 연습은 강의의 일부입니다
Python으로 시계열 데이터 다루기
연습 안내
.info()를 사용하여listings를 살펴보세요.'Stock Symbol'열을 인덱스로 이동하세요(inplace사용).'Sector'정보가 누락된 기업을listings에서 제거하세요.- IPO 연도가 2019년 이전인 기업을 선택하세요.
.info()를 사용하여 변경된 결과를 확인하세요..groupby()와.size()를 사용하여'Sector'별 기업 수를 구하고, 결과를 내림차순으로 정렬하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Inspect listings
print(____)
# Move 'stock symbol' into the index
# Drop rows with missing 'sector' data
# Select companies with IPO Year before 2019
listings = ____
# Inspect the new listings data
print(____)
# Show the number of companies per sector
print(____)