파일의 시작 부분은 어떻게 볼 수 있나요?
새로운 데이터셋을 받으면, 대부분의 데이터 과학자는 가장 먼저 어떤 필드가 있고 각 필드에 어떤 값이 들어 있는지 파악합니다. 데이터베이스나 스프레드시트에서 내보낸 데이터셋이라면 대개 comma-separated values(CSV) 형식으로 저장됩니다. 내용을 빠르게 파악하는 좋은 방법은 처음 몇 행을 확인하는 것입니다.
셸에서는 head라는 명령으로 이를 할 수 있습니다.
이름에서 알 수 있듯이,
파일의 처음 몇 줄을 출력합니다
(여기서 "몇"은 10줄을 의미합니다),
따라서 다음 명령을 실행하면:
head seasonal/summer.csv
다음과 같이 표시됩니다:
Date,Tooth
2017-01-11,canine
2017-01-18,wisdom
2017-01-21,bicuspid
2017-02-02,molar
2017-02-27,wisdom
2017-02-27,wisdom
2017-03-07,bicuspid
2017-03-15,wisdom
2017-03-20,canine
파일에 10줄이 없으면 head는 무엇을 할까요?
(직접 확인해 보려면 people/agarwal.txt의 앞부분을 확인해 보세요.)
이 연습은 강의의 일부입니다
