고급 대치(Imputation)
현실의 많은 데이터셋에는 누락되거나 손상된 데이터가 많습니다. 종종 데이터셋의 문제 있는 부분을 그대로 버리는 것은 비효율적이고 낭비가 됩니다. 대치(imputation)를 사용하면 누락되거나 비어 있는 값을 상수값이나 유사한 특성의 평균 등 합리적인 값으로 채워 실제 데이터에 최대한 가깝게 만들 수 있습니다. 더 발전되고 정확한 방법은 Machine Learning을 사용해 채울 최적의 값을 예측하는 것입니다.
이 연습은 강의의 일부입니다
