데이터 불러오기와 분할하기
프로덕션 환경에 모델을 배포하고 모니터링하려면, 먼저 모델을 만들어야 합니다. 이전 영상에서는 데이터 로딩과 전처리, 모델 구성, 그리고 reference/analysis 세트 생성 과정을 살펴봤습니다.
이 연습에서는 비슷한 과정을 따라가지만, 더 단순화하기 위해 이미 전처리된 csv 파일 형태의 NYC Green Taxi 데이터셋을 사용합니다.
이번 연습을 위해 pandas는 pd로 임포트되어 있어 바로 사용하실 수 있습니다.
이 연습은 강의의 일부입니다
Python으로 Machine Learning 모니터링
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Load the dataset
dataset_name = ____
data = pd.____(____)
____.____()