반복적 대치(Iterative imputation)
이전 연습 문제에서는 loan_data의 결측값을 평균으로 대치했어요. 하지만 Machine Learning 면접에서는 데이터셋의 다른 특성에 의존하는, 더 동적인 대치 기법에 대해 묻는 경우가 많습니다.
이번 연습에서는 sklearn.impute의 IterativeImputer()를 사용해 남아 있는 특성들을 함수로 하여 결측값을 채우는 머신러닝 기반 접근법을 연습해 볼 거예요. 이는 다변량 대치 기법으로, 각 특성을 나머지 모든 특성으로부터 ‘라운드로빈’ 방식으로 추정합니다.
이 함수는 실험적 기능로 분류되므로, 자세한 내용은 문서를 참고해 주세요.
지금은 파이프라인에서 다음 단계에 와 있습니다:

이 연습은 강의의 일부입니다
Python으로 연습하는 Machine Learning 면접 질문
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Explicitly require this experimental feature
from sklearn.experimental import enable_iterative_imputer
# Now you can import normally from sklearn.impute
from sklearn.impute import IterativeImputer
# Subset numeric features: numeric_cols
numeric_cols = ____.____(____=[____.____])