Začněte nyníZačněte zdarma

Vytváření binárních masek

Obrázky pro segmentační úlohy jsou obvykle anotovány maskami na úrovni pixelů. Podívej se na tento snímek kočky egyptské.

cat image

V tomto a následujícím cvičení použiješ příslušnou masku k tomu, aby ses kočku ze snímku vyčlenil/a. Nejprve je potřeba masku načíst a binarizovat.

Image z PIL, transforms z torchvision a torch jsou již naimportovány.

Toto cvičení je součástí kurzu

Deep Learning pro obrázky s PyTorchem

Zobrazit kurz

Pokyny k cvičení

  • Načti obrázek masky uložený v annotations/Egyptian_Mau_123.png a přiřaď ho do proměnné mask.
  • Vytvoř binary_mask z mask_tensor tak, aby každý pixel s hodnotou 1/255 dostal tenzorovou hodnotu 1.0 a všechny ostatní pixely tenzorovou hodnotu 0.0.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Load mask image
mask = ____

# Transform mask to tensor
transform = transforms.Compose([transforms.ToTensor()])
mask_tensor = transform(mask)

# Create binary mask
binary_mask = ____(
    ____, 
    ____,
    ____,
)

# Print unique mask values
print(binary_mask.unique())
Upravit a spustit kód