Tokenizarea textului
În acest exercițiu, vei folosi setul de date flickr, care conține 30.000 de imagini și descrieri asociate, pentru a efectua operații de preprocesare pe text. Acest pas este necesar pentru ca modelele să poată realiza sarcini precum clasificarea textului. Este deosebit de util în aplicațiile multi-modale, unde modelele Hugging Face pot verifica dacă o descriere este potrivită pentru imaginea asociată.
Setul de date (dataset) a fost încărcat, iar AutoTokenizer a fost importat.
Acest exercițiu face parte din cursul
Modele Multi-Modale cu Hugging Face
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Load the first caption from the image at index 5
text = dataset[5]["____"][0]
print(text)