Začněte nyníZačněte zdarma

Generování popisků pomocí pipeline

V tomto cvičení opět použiješ dataset flickr, který obsahuje 30 000 obrázků s přiřazenými popisky. Tentokrát vygeneruješ popisek k následujícímu obrázku pomocí pipeline místo tříd auto.

Photo of a man standing on a ladder cleaning a window

Dataset (dataset) byl načten s touto strukturou:

Dataset({
    features: ['image', 'caption', 'sentids', 'split', 'img_id', 'filename'],
    num_rows: 10
})

Modul pipeline (pipeline) je již načtený.

Toto cvičení je součástí kurzu

Multi-Modal Models with Hugging Face

Zobrazit kurz

Pokyny k cvičení

  • Načti pipeline image-to-text s předtrénovaným modelem Salesforce/blip-image-captioning-base.
  • Pomocí pipeline vygeneruj popisek pro obrázek na indexu 3.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Load the image-to-text pipeline
pipe = pipeline(task="____", model="____")

# Use the pipeline to generate a caption with the image of datapoint 3
pred = ____(dataset[3]["____"])

print(pred)
Upravit a spustit kód