Förbered för 8-bitars träning
Du ville påbörja RLHF-finjustering, men stötte hela tiden på minnesbegränsningsfel. För att lösa detta valde du att byta till 8-bitars precision, vilket möjliggör effektivare finjustering med hjälp av Hugging Face-biblioteket peft.
Följande har redan importerats:
AutoModelForCausalLMfråntransformersprepare_model_for_int8_trainingfrånpeftAutoModelForCausalLMWithValueHeadfråntrl
Den här övningen är en del av kursen
Reinforcement Learning from Human Feedback (RLHF)
Övningsinstruktioner
- Läs in den förtränade modellen och se till att inkludera parametern för 8-bitars precision.
- Använd funktionen
prepare_model_for_int8_trainingför att förbereda modellen för LoRA-baserad finjustering. - Läs in modellen med ett värde-huvud för
PPO-träning.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
model_name = "gpt2"
# Load the model in 8-bit precision
pretrained_model = AutoModelForCausalLM.from_pretrained(
model_name,
____=True
)
# Prepare the model for fine-tuning
pretrained_model_8bit = ____(pretrained_model)
# Load the model with a value head
model = ____.from_pretrained(pretrained_model_8bit)