Bildtensorer
Ett kaffeföretag arbetar med ett objektdetekteringsprojekt där de behöver annotera intresseobjekt – i det här fallet espressoskott. Du har skapat en lista med koordinaterna för en avgränsningsruta (bounding box) för en espressoskottsbild. Nu ska du konvertera bilden och koordinaterna till tensorer.
torch och torchvision har importerats. torchvision.transforms är importerat som transforms. Bilden har laddats in som image med hjälp av Image.open() från biblioteket PIL. Koordinaterna för avgränsningsrutan är lagrade i variabeln bbox.

Den här övningen är en del av kursen
Djupinlärning för bilder med PyTorch
Övningsinstruktioner
- Konvertera
bboxtill tensorer med hjälp avtorch.tensor(). - Omforma
bbox_tensorgenom att lägga till en batchdimension medunsqueeze(0). - Skapa en transform som ändrar storleken på
imagetill(224)och omvandlar den till en oskalad bildtensor. - Applicera
transformpåimage.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Convert bbox into tensors
bbox_tensor = ____
# Add a new batch dimension
bbox_tensor = bbox_tensor.____
# Resize image and transform tensor
transform = transforms.Compose([
transforms.____,
transforms.____
])
# Apply transform to image
image_tensor = ____
print(image_tensor)