НачатьНачать бесплатно

Тензоры изображений

Кофейная компания реализует проект по обнаружению объектов, в рамках которого необходимо размечать интересующие объекты — в данном случае порции эспрессо. Вы составили список с координатами ограничивающего прямоугольника для изображения с эспрессо. Теперь нужно преобразовать изображение и координаты в тензоры.

Библиотеки torch и torchvision уже импортированы. torchvision.transforms импортирован как transforms. Изображение загружено в переменную image с помощью Image.open() из библиотеки PIL. Координаты ограничивающего прямоугольника хранятся в переменной bbox.

espresso

Это упражнение является частью курса

Глубокое обучение для работы с изображениями на PyTorch

Посмотреть курс

Инструкции к упражнению

  • Преобразуйте bbox в тензор с помощью torch.tensor().
  • Измените форму bbox_tensor, добавив размерность батча с помощью unsqueeze(0).
  • Создайте трансформацию, которая изменяет размер image до (224) и преобразует изображение в немасштабированный тензор.
  • Примените transform к image.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Convert bbox into tensors
bbox_tensor = ____

# Add a new batch dimension
bbox_tensor = bbox_tensor.____

# Resize image and transform tensor
transform = transforms.Compose([
  transforms.____,
  transforms.____
])

# Apply transform to image
image_tensor = ____
print(image_tensor)
Редактировать и запускать код