ÎncepețiÎncepe gratuit

Tensori de imagine

O companie de cafea derulează un proiect de detecție a obiectelor în care trebuie să adnoteze obiectele de interes – în acest caz, shot-uri de espresso. Ai creat o listă cu coordonatele casetei de delimitare (bounding box) pentru o imagine cu un shot de espresso. Acum trebuie să convertești imaginea și coordonatele în tensori.

torch și torchvision au fost importate. torchvision.transforms este importat ca transforms. Imaginea a fost încărcată în variabila image folosind Image.open() din biblioteca PIL. Coordonatele casetei de delimitare sunt stocate în variabila bbox.

espresso

Acest exercițiu face parte din cursul

Deep Learning pentru imagini cu PyTorch

Vezi cursul

Instrucțiuni pentru exercițiu

  • Convertește bbox în tensori folosind torch.tensor().
  • Remodelează bbox_tensor adăugând o dimensiune de lot (batch) cu unsqueeze(0).
  • Creează o transformare care redimensionează image la (224) și o convertește într-un tensor de imagine neescalatat.
  • Aplică transform pe image.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Convert bbox into tensors
bbox_tensor = ____

# Add a new batch dimension
bbox_tensor = bbox_tensor.____

# Resize image and transform tensor
transform = transforms.Compose([
  transforms.____,
  transforms.____
])

# Apply transform to image
image_tensor = ____
print(image_tensor)
Editează și rulează codul