전처리된 데이터셋 저장하기
고객 지원 챗봇 프로젝트의 일부로, 이제 Llama 모델 미세 조정을 위한 데이터셋을 준비했어요. 다음 단계는 이 데이터셋을 저장해 두는 것입니다. 이렇게 하면 전처리 과정을 반복하지 않고 나중에 다시 불러올 수 있어요. 이를 통해 팀이 여러 실험과 반복 과정에서 데이터셋을 재사용할 수 있습니다.
이 연습은 강의의 일부입니다
Llama 3 미세 조정(Fine-Tuning)
연습 안내
- 전처리된 데이터셋
ds를 디스크에 저장하세요. - 저장한 데이터셋을 새 변수
ds_preprocessed로 불러오세요. ds_preprocessed의 첫 번째 요소를 출력하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
from datasets import load_from_disk
# Save the dataset to disk
____
# Load the dataset from disk
ds_preprocessed = ____
# Print the first element of the loaded dataset
print(____)