Tensory obrazów
Firma kawowa realizuje projekt wykrywania obiektów, w którym trzeba oznaczać interesujące obiekty – w tym przypadku porcje espresso. Masz listę ze współrzędnymi ramki ograniczającej dla obrazu z espresso. Teraz musisz przekonwertować obraz i współrzędne na tensory.
torch i torchvision są już zaimportowane. torchvision.transforms jest zaimportowane jako transforms. Obraz został wczytany jako image za pomocą Image.open() z biblioteki PIL. Współrzędne ramki ograniczającej są przechowywane w zmiennej bbox.

To ćwiczenie jest częścią kursu
Głębokie uczenie dla obrazów z PyTorch
Instrukcje do ćwiczenia
- Przekonwertuj
bboxna tensory za pomocątorch.tensor(). - Zmień kształt
bbox_tensor, dodając wymiar wsadowy (batch) za pomocąunsqueeze(0). - Utwórz transformację, która zmieni rozmiar
imagedo(224)i przekształci go w nieskalowany tensor obrazu. - Zastosuj
transformdoimage.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Convert bbox into tensors
bbox_tensor = ____
# Add a new batch dimension
bbox_tensor = bbox_tensor.____
# Resize image and transform tensor
transform = transforms.Compose([
transforms.____,
transforms.____
])
# Apply transform to image
image_tensor = ____
print(image_tensor)