Příprava na 8bitový trénink
Chtěl/a jsi spustit fine-tuning s RLHF, ale narážel/a jsi na chyby způsobené nedostatkem paměti. Jako řešení jsi zvolil/a přechod na 8bitovou přesnost, která umožňuje efektivnější fine-tuning – a to díky knihovně peft od Hugging Face.
Následující položky jsou již naimportované:
AutoModelForCausalLMztransformersprepare_model_for_int8_trainingzpeftAutoModelForCausalLMWithValueHeadztrl
Toto cvičení je součástí kurzu
Reinforcement Learning from Human Feedback (RLHF)
Pokyny k cvičení
- Načti předtrénovaný model a nezapomeň přidat parametr pro 8bitovou přesnost.
- Pomocí funkce
prepare_model_for_int8_trainingpřiprav model na fine-tuning založený na LoRA. - Načti model s value head pro trénink
PPO.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
model_name = "gpt2"
# Load the model in 8-bit precision
pretrained_model = AutoModelForCausalLM.from_pretrained(
model_name,
____=True
)
# Prepare the model for fine-tuning
pretrained_model_8bit = ____(pretrained_model)
# Load the model with a value head
model = ____.from_pretrained(pretrained_model_8bit)