Klasifikace generovaného textu pro RLHF
Teď chceš kategorizovat vygenerované recenze. Jedním ze způsobů, jak vyhodnotit výstup, je měření pozitivity vygenerovaných recenzí pomocí klasifikátoru lvwerra/distilbert-imdb, který také můžeš vytvořit pomocí Hugging Face pipeline.
Knihovna pipeline je předem naimportována z transformers. Model lvwerra/distilbert-imdb je předem načten jako model. Tokenizer je předem načten jako tokenizer.
Toto cvičení je součástí kurzu
Reinforcement Learning from Human Feedback (RLHF)
Pokyny k cvičení
- Pomocí funkce
pipelinevytvoř pipeline pro analýzu sentimentu s daným modelem. - Klasifikuj sentiment zadané recenze.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create a sentiment analysis pipeline
sentiment_analyzer = pipeline(____, model=____, tokenizer=____)
review_text = "Surprisingly, the film is a very good one"
# Classify the sentiment of the review
sentiment = sentiment_analyzer(____)
print(f"Sentiment Analysis Result: {sentiment}")