Vytváření binárních masek
Obrázky pro segmentační úlohy jsou obvykle anotovány maskami na úrovni pixelů. Podívej se na tento snímek kočky egyptské.

V tomto a následujícím cvičení použiješ příslušnou masku k tomu, aby ses kočku ze snímku vyčlenil/a. Nejprve je potřeba masku načíst a binarizovat.
Image z PIL, transforms z torchvision a torch jsou již naimportovány.
Toto cvičení je součástí kurzu
Deep Learning pro obrázky s PyTorchem
Pokyny k cvičení
- Načti obrázek masky uložený v
annotations/Egyptian_Mau_123.pnga přiřaď ho do proměnnémask. - Vytvoř
binary_maskzmask_tensortak, aby každý pixel s hodnotou1/255dostal tenzorovou hodnotu1.0a všechny ostatní pixely tenzorovou hodnotu0.0.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Load mask image
mask = ____
# Transform mask to tensor
transform = transforms.Compose([transforms.ToTensor()])
mask_tensor = transform(mask)
# Create binary mask
binary_mask = ____(
____,
____,
____,
)
# Print unique mask values
print(binary_mask.unique())