CommencezCommencez gratuitement

Traduction automatique avec un modèle PyTorch préentraîné

Votre équipe chez PyBooks travaille sur un projet d'IA qui consiste à traduire d'une langue à une autre. Elle souhaite tirer parti de modèles préentraînés pour cette tâche, ce qui peut faire économiser beaucoup de temps d'apprentissage et de ressources. Dans cet exercice, vous devez configurer un modèle de traduction à partir de la bibliothèque Transformers de HuggingFace, en particulier le modèle T5 (Text-To-Text Transfer Transformer), et l'utiliser pour traduire une phrase anglaise en français.

T5Tokenizer, T5ForConditionalGeneration ont été chargés pour vous.

Cette activité fait partie du cours

Apprentissage profond pour le texte avec PyTorch

Voir le cours

Instructions de l’exercice

  • Initialisez le tokenizer et le model à partir du modèle préentraîné "t5-small".
  • Encodez l'invite d'entrée avec le tokenizer, en vous assurant de retourner des tenseurs PyTorch.
  • Traduisez l'invite d'entrée avec model et générez la sortie traduite.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Initalize tokenizer and model
tokenizer = ____.from_pretrained("t5-small")
model = ____.from_pretrained("t5-small")

input_prompt = "translate English to French: 'Hello, how are you?'"

# Encode the input prompt using the tokenizer
input_ids = ____.____(input_prompt, return_tensors="____")

# Generate the translated ouput
output = model.____(input_ids, max_length=50)
generated_text = tokenizer.decode(output[0], skip_special_tokens=True)
print("Generated text:",generated_text)
Modifier et exécuter le code