Traduction automatique avec un modèle PyTorch préentraîné
Votre équipe chez PyBooks travaille sur un projet d'IA qui consiste à traduire d'une langue à une autre. Elle souhaite tirer parti de modèles préentraînés pour cette tâche, ce qui peut faire économiser beaucoup de temps d'apprentissage et de ressources. Dans cet exercice, vous devez configurer un modèle de traduction à partir de la bibliothèque Transformers de HuggingFace, en particulier le modèle T5 (Text-To-Text Transfer Transformer), et l'utiliser pour traduire une phrase anglaise en français.
T5Tokenizer, T5ForConditionalGeneration ont été chargés pour vous.
Cette activité fait partie du cours
Apprentissage profond pour le texte avec PyTorch
Instructions de l’exercice
- Initialisez le
tokenizeret lemodelà partir du modèle préentraîné"t5-small". - Encodez l'invite d'entrée avec le tokenizer, en vous assurant de retourner des tenseurs PyTorch.
- Traduisez l'invite d'entrée avec
modelet générez la sortie traduite.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Initalize tokenizer and model
tokenizer = ____.from_pretrained("t5-small")
model = ____.from_pretrained("t5-small")
input_prompt = "translate English to French: 'Hello, how are you?'"
# Encode the input prompt using the tokenizer
input_ids = ____.____(input_prompt, return_tensors="____")
# Generate the translated ouput
output = model.____(input_ids, max_length=50)
generated_text = tokenizer.decode(output[0], skip_special_tokens=True)
print("Generated text:",generated_text)