Začněte nyníZačněte zdarma

Příprava na 8bitový trénink

Chtěl/a jsi spustit fine-tuning s RLHF, ale narážel/a jsi na chyby způsobené nedostatkem paměti. Jako řešení jsi zvolil/a přechod na 8bitovou přesnost, která umožňuje efektivnější fine-tuning – a to díky knihovně peft od Hugging Face.

Následující položky jsou již naimportované:

  • AutoModelForCausalLM z transformers
  • prepare_model_for_int8_training z peft
  • AutoModelForCausalLMWithValueHead z trl

Toto cvičení je součástí kurzu

Reinforcement Learning from Human Feedback (RLHF)

Zobrazit kurz

Pokyny k cvičení

  • Načti předtrénovaný model a nezapomeň přidat parametr pro 8bitovou přesnost.
  • Pomocí funkce prepare_model_for_int8_training připrav model na fine-tuning založený na LoRA.
  • Načti model s value head pro trénink PPO.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

model_name = "gpt2"  

# Load the model in 8-bit precision
pretrained_model = AutoModelForCausalLM.from_pretrained(
                                                       model_name, 
                                                       ____=True
                                                      )

# Prepare the model for fine-tuning
pretrained_model_8bit = ____(pretrained_model)

# Load the model with a value head
model = ____.from_pretrained(pretrained_model_8bit)
Upravit a spustit kód