ÎncepețiÎncepe gratuit

Pregătire pentru antrenament pe 8 biți

Ai vrut să începi fine-tuning-ul cu RLHF, dar ai întâlnit în mod repetat erori de memorie insuficientă. Pentru a rezolva această problemă, ai decis să treci la precizia pe 8 biți, care permite un fine-tuning mai eficient, folosind biblioteca peft de la Hugging Face.

Următoarele au fost pre-importate:

  • AutoModelForCausalLM din transformers
  • prepare_model_for_int8_training din peft
  • AutoModelForCausalLMWithValueHead din trl

Acest exercițiu face parte din cursul

Reinforcement Learning from Human Feedback (RLHF)

Vezi cursul

Instrucțiuni pentru exercițiu

  • Încarcă modelul pre-antrenat și asigură-te că incluzi parametrul pentru precizia pe 8 biți.
  • Folosește funcția prepare_model_for_int8_training pentru a pregăti modelul pentru fine-tuning bazat pe LoRA.
  • Încarcă modelul cu un cap de valoare (value head) pentru antrenamentul PPO.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

model_name = "gpt2"  

# Load the model in 8-bit precision
pretrained_model = AutoModelForCausalLM.from_pretrained(
                                                       model_name, 
                                                       ____=True
                                                      )

# Prepare the model for fine-tuning
pretrained_model_8bit = ____(pretrained_model)

# Load the model with a value head
model = ____.from_pretrained(pretrained_model_8bit)
Editează și rulează codul