리뷰 분류를 위한 파인튜닝
프로젝트를 이어서, 이제 리뷰를 긍정, 중립, 부정으로 분류하려고 해요. 파인튜닝된 모델을 사용해 리뷰를 자동으로 범주화할 거예요.
transformers에서 TrainingArguments와 Trainer 클래스가 이미 임포트되어 있어요.
training_args, model, tokenized_datasets도 미리 임포트되어 있어요.
이 연습은 강의의 일부입니다
Reinforcement Learning from Human Feedback (RLHF)
연습 안내
tokenized_datasets데이터셋에서"train"과"test"하위 집합을 사용해 학습/테스트 데이터셋을 만드세요.- Trainer 클래스를 초기화하세요.
- 학습 인자를 클래스에 추가하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Define the train and test datasets
training_dataset = ____
testing_dataset = ____
# Initialize the trainer class
trainer = ____(
# Add arguments to the class
model=model,
args=training_args,
train_dataset=____,
eval_dataset=____
)