시작하기무료로 시작하기

전처리된 데이터셋 저장하기

고객 지원 챗봇 프로젝트의 일부로, 이제 Llama 모델 미세 조정을 위한 데이터셋을 준비했어요. 다음 단계는 이 데이터셋을 저장해 두는 것입니다. 이렇게 하면 전처리 과정을 반복하지 않고 나중에 다시 불러올 수 있어요. 이를 통해 팀이 여러 실험과 반복 과정에서 데이터셋을 재사용할 수 있습니다.

이 연습은 강의의 일부입니다

Llama 3 미세 조정(Fine-Tuning)

강의 보기

연습 안내

  • 전처리된 데이터셋 ds를 디스크에 저장하세요.
  • 저장한 데이터셋을 새 변수 ds_preprocessed로 불러오세요.
  • ds_preprocessed의 첫 번째 요소를 출력하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

from datasets import load_from_disk

# Save the dataset to disk
____

# Load the dataset from disk
ds_preprocessed = ____

# Print the first element of the loaded dataset
print(____)
코드 편집 및 실행