의사결정나무 모델 학습
이제 통신사 데이터셋의 학습용 세트에 의사결정나무를 학습한 뒤, 보지 못했던 테스트 데이터에 대한 라벨을 예측하고, 모델 예측의 정확도를 계산해 보겠습니다. 그러면 로지스틱 회귀와 성능 차이를 확인할 수 있어요.
accuracy_score 함수가 이미 임포트되어 있으며, 이전에 구성한 학습/테스트 데이터셋도 불러와서 특성은 train_X, test_X, 타깃 변수는 train_Y, test_Y로 준비되어 있습니다.
이 연습은 강의의 일부입니다
Python으로 배우는 마케팅용 Machine Learning
연습 안내
- 의사결정나무 분류기를 초기화하세요.
- 학습 데이터를 사용해 의사결정나무를 학습(fit)하세요.
- 테스트 데이터에 대해 이탈(churn) 라벨을 예측하세요.
- 테스트 데이터의 정확도를 계산하고 출력하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Initialize decision tree classifier
mytree = tree.___()
# Fit the decision tree on training data
mytree.___(___, ___)
# Predict churn labels on testing data
pred_test_Y = ___.___(___)
# Calculate accuracy score on testing data
test_accuracy = ___(___, ___)
# Print test accuracy
print('Test accuracy:', round(___, 4))