Zacznij terazZacznij za darmo

Tensory obrazów

Firma kawowa realizuje projekt wykrywania obiektów, w którym trzeba oznaczać interesujące obiekty – w tym przypadku porcje espresso. Masz listę ze współrzędnymi ramki ograniczającej dla obrazu z espresso. Teraz musisz przekonwertować obraz i współrzędne na tensory.

torch i torchvision są już zaimportowane. torchvision.transforms jest zaimportowane jako transforms. Obraz został wczytany jako image za pomocą Image.open() z biblioteki PIL. Współrzędne ramki ograniczającej są przechowywane w zmiennej bbox.

espresso

To ćwiczenie jest częścią kursu

Głębokie uczenie dla obrazów z PyTorch

Zobacz kurs

Instrukcje do ćwiczenia

  • Przekonwertuj bbox na tensory za pomocą torch.tensor().
  • Zmień kształt bbox_tensor, dodając wymiar wsadowy (batch) za pomocą unsqueeze(0).
  • Utwórz transformację, która zmieni rozmiar image do (224) i przekształci go w nieskalowany tensor obrazu.
  • Zastosuj transform do image.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Convert bbox into tensors
bbox_tensor = ____

# Add a new batch dimension
bbox_tensor = bbox_tensor.____

# Resize image and transform tensor
transform = transforms.Compose([
  transforms.____,
  transforms.____
])

# Apply transform to image
image_tensor = ____
print(image_tensor)
Edytuj i uruchom kod