Kom igångKom igång gratis

Bildtensorer

Ett kaffeföretag arbetar med ett objektdetekteringsprojekt där de behöver annotera intresseobjekt – i det här fallet espressoskott. Du har skapat en lista med koordinaterna för en avgränsningsruta (bounding box) för en espressoskottsbild. Nu ska du konvertera bilden och koordinaterna till tensorer.

torch och torchvision har importerats. torchvision.transforms är importerat som transforms. Bilden har laddats in som image med hjälp av Image.open() från biblioteket PIL. Koordinaterna för avgränsningsrutan är lagrade i variabeln bbox.

espresso

Den här övningen är en del av kursen

Djupinlärning för bilder med PyTorch

Visa kurs

Övningsinstruktioner

  • Konvertera bbox till tensorer med hjälp av torch.tensor().
  • Omforma bbox_tensor genom att lägga till en batchdimension med unsqueeze(0).
  • Skapa en transform som ändrar storleken på image till (224) och omvandlar den till en oskalad bildtensor.
  • Applicera transformimage.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Convert bbox into tensors
bbox_tensor = ____

# Add a new batch dimension
bbox_tensor = bbox_tensor.____

# Resize image and transform tensor
transform = transforms.Compose([
  transforms.____,
  transforms.____
])

# Apply transform to image
image_tensor = ____
print(image_tensor)
Redigera och kör kod