始める無料で始める

ボックス回帰ブロック

最後のタスクは、バウンディングボックスの座標を予測する回帰ブロックを作成することです。先ほど定義した分類器と同様に、間に ReLU 活性化を挟んだ全結合層 2 層のブロックにすることにします。

vgg_modelinput_dim は引き続き利用可能で、torchtorchvision.models はすでにインポートされています。

この演習はコースの一部です

PyTorch で学ぶ画像向け Deep Learning

コースを見る

演習の手順

  • 予測するバウンディングボックス座標の数を表す変数 num_coordinates を作成します。
  • 最初の全結合層の適切な入力次元を指定し、出力次元を 32 に設定します。
  • 回帰器の最後の層で適切な出力次元を指定します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Define the number of coordinates
____

bb = nn.Sequential(  
	# Add input and output dimensions
	nn.Linear(____, ____),
	nn.ReLU(),
	# Add the output for the last regression layer
	nn.Linear(32, ____),
)
コードを編集して実行