Тензоры изображений
Кофейная компания реализует проект по обнаружению объектов, в рамках которого необходимо размечать интересующие объекты — в данном случае порции эспрессо. Вы составили список с координатами ограничивающего прямоугольника для изображения с эспрессо. Теперь нужно преобразовать изображение и координаты в тензоры.
Библиотеки torch и torchvision уже импортированы. torchvision.transforms импортирован как transforms. Изображение загружено в переменную image с помощью Image.open() из библиотеки PIL. Координаты ограничивающего прямоугольника хранятся в переменной bbox.

Это упражнение является частью курса
Глубокое обучение для работы с изображениями на PyTorch
Инструкции к упражнению
- Преобразуйте
bboxв тензор с помощьюtorch.tensor(). - Измените форму
bbox_tensor, добавив размерность батча с помощьюunsqueeze(0). - Создайте трансформацию, которая изменяет размер
imageдо(224)и преобразует изображение в немасштабированный тензор. - Примените
transformкimage.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Convert bbox into tensors
bbox_tensor = ____
# Add a new batch dimension
bbox_tensor = bbox_tensor.____
# Resize image and transform tensor
transform = transforms.Compose([
transforms.____,
transforms.____
])
# Apply transform to image
image_tensor = ____
print(image_tensor)