Začněte nyníZačněte zdarma

Generování textu s RLHF

V tomto cvičení budeš pracovat s modelem předtrénovaným pomocí RLHF s názvem lvwerra/gpt2-imdb-pos-v2. Je to příležitost procvičit si sestavení Hugging Face pipeline a otestovat jeden z případů použití modelů trénovaných s RLHF: generování filmových recenzí.

Objekty pipeline, AutoModelForCausalLM, and AutoTokenizer byly předem importovány z transformers. tokenizer byl předem načten.

Toto cvičení je součástí kurzu

Reinforcement Learning from Human Feedback (RLHF)

Zobrazit kurz

Pokyny k cvičení

  • Nastav název modelu na lvwerra/gpt2-imdb-pos-v2 – model předtrénovaný s RLHF.
  • Pomocí funkce pipeline vytvoř pipeline pro text-generation.
  • Pomocí této pipeline vygeneruj pokračování zadané recenze.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Set the model name
model_name = ____
model = AutoModelForCausalLM.from_pretrained(model_name)
tokenizer = AutoTokenizer.from_pretrained(model_name)

# Create a text generation pipeline
text_generator = pipeline(____, model=model, tokenizer=tokenizer)

review_prompt = "Surprisingly, the film"

# Generate a continuation of the review
generated_text = text_generator(____, max_length=10)
print(f"Generated Review Continuation: {generated_text[0]['generated_text']}")
Upravit a spustit kód