Pregătire pentru antrenament pe 8 biți
Ai vrut să începi fine-tuning-ul cu RLHF, dar ai întâlnit în mod repetat erori de memorie insuficientă. Pentru a rezolva această problemă, ai decis să treci la precizia pe 8 biți, care permite un fine-tuning mai eficient, folosind biblioteca peft de la Hugging Face.
Următoarele au fost pre-importate:
AutoModelForCausalLMdintransformersprepare_model_for_int8_trainingdinpeftAutoModelForCausalLMWithValueHeaddintrl
Acest exercițiu face parte din cursul
Reinforcement Learning from Human Feedback (RLHF)
Instrucțiuni pentru exercițiu
- Încarcă modelul pre-antrenat și asigură-te că incluzi parametrul pentru precizia pe 8 biți.
- Folosește funcția
prepare_model_for_int8_trainingpentru a pregăti modelul pentru fine-tuning bazat pe LoRA. - Încarcă modelul cu un cap de valoare (value head) pentru antrenamentul
PPO.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
model_name = "gpt2"
# Load the model in 8-bit precision
pretrained_model = AutoModelForCausalLM.from_pretrained(
model_name,
____=True
)
# Prepare the model for fine-tuning
pretrained_model_8bit = ____(pretrained_model)
# Load the model with a value head
model = ____.from_pretrained(pretrained_model_8bit)