or
이 연습은 강의의 일부입니다
데이터가 어떻게 수집되고, 처리되며, 데이터 파이프라인을 통해 이동하는지 알아볼 준비를 하세요. 뛰어난 데이터 파이프라인의 특성을 살펴보고, 직접 설계하고 구축할 준비를 갖춥니다.
pandas를 활용해 데이터를 추출하고, 변환하고, 적재하면서 첫 번째 데이터 파이프라인을 만들어 봅니다. 재사용 가능한 ETL 로직을 작성하고, 파이프라인에 로깅과 예외 처리를 적용하는 방법을 배웁니다.
비정형 데이터 처리, DataFrame을 SQL 데이터베이스에 저장하기 등 고급 데이터 파이프라이닝 기법으로 워크플로를 한층 강화하세요. pandas로 고급 변환을 수행하는 도구를 익히고, 복잡한 데이터 작업에 대한 모범 사례를 알아봅니다.
마지막 장에서는 프로덕션 배포 전 데이터 파이프라인을 검증하고 테스트하는 프레임워크를 만듭니다. 파이프라인을 테스트한 뒤에는, 성능 가시성을 확보하면서 파이프라인을 처음부터 끝까지 실행하는 방법을 살펴봅니다.
현재 연습