Generování popisků pomocí pipeline
V tomto cvičení opět použiješ dataset flickr, který obsahuje 30 000 obrázků s přiřazenými popisky. Tentokrát vygeneruješ popisek k následujícímu obrázku pomocí pipeline místo tříd auto.

Dataset (dataset) byl načten s touto strukturou:
Dataset({
features: ['image', 'caption', 'sentids', 'split', 'img_id', 'filename'],
num_rows: 10
})
Modul pipeline (pipeline) je již načtený.
Toto cvičení je součástí kurzu
Multi-Modal Models with Hugging Face
Pokyny k cvičení
- Načti pipeline
image-to-texts předtrénovaným modelemSalesforce/blip-image-captioning-base. - Pomocí pipeline vygeneruj popisek pro obrázek na indexu
3.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Load the image-to-text pipeline
pipe = pipeline(task="____", model="____")
# Use the pipeline to generate a caption with the image of datapoint 3
pred = ____(dataset[3]["____"])
print(pred)