Kom igångKom igång gratis

Förbered för 8-bitars träning

Du ville påbörja RLHF-finjustering, men stötte hela tiden på minnesbegränsningsfel. För att lösa detta valde du att byta till 8-bitars precision, vilket möjliggör effektivare finjustering med hjälp av Hugging Face-biblioteket peft.

Följande har redan importerats:

  • AutoModelForCausalLM från transformers
  • prepare_model_for_int8_training från peft
  • AutoModelForCausalLMWithValueHead från trl

Den här övningen är en del av kursen

Reinforcement Learning from Human Feedback (RLHF)

Visa kurs

Övningsinstruktioner

  • Läs in den förtränade modellen och se till att inkludera parametern för 8-bitars precision.
  • Använd funktionen prepare_model_for_int8_training för att förbereda modellen för LoRA-baserad finjustering.
  • Läs in modellen med ett värde-huvud för PPO-träning.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

model_name = "gpt2"  

# Load the model in 8-bit precision
pretrained_model = AutoModelForCausalLM.from_pretrained(
                                                       model_name, 
                                                       ____=True
                                                      )

# Prepare the model for fine-tuning
pretrained_model_8bit = ____(pretrained_model)

# Load the model with a value head
model = ____.from_pretrained(pretrained_model_8bit)
Redigera och kör kod