arXiv reaDer
コンテンツベースの画像検索のためのテスト時間拡張の学習
Learning Test-time Augmentation for Content-based Image Retrieval
既成の畳み込みニューラルネットワーク機能は、多くの画像検索タスクで卓越した結果を達成します。ただし、ターゲットデータに対する不変性は、ネットワークアーキテクチャとトレーニングデータによって事前に定義されています。既存の画像検索アプローチでは、ターゲットデータに固有のバリエーションに適応するために、事前にトレーニングされたネットワークを微調整または変更する必要があります。対照的に、私たちの方法は、強化学習を通じて学習されたポリシーによって導かれる拡張を使用して、テスト時に拡張された画像から抽出された特徴を集約することによって、既製の機能の不変性を強化します。学習したポリシーは、画像変換のリストから選択された選択された変換にさまざまな大きさと重みを割り当てます。ポリシーは、メトリック学習プロトコルを使用して評価され、最適なポリシーを学習します。モデルは迅速に収束し、拡張画像から特徴を抽出する計算コストを大幅に削減するオフラインキャッシング手法を提案するため、各ポリシー反復のコストは最小限に抑えられます。大規模な商標検索(METU商標データセット)およびランドマーク検索(ROxford5kおよびRParis6kシーンデータセット)タスクの実験結果は、学習した変換のアンサンブルがパフォーマンスの向上に非常に効果的であり、実用的で転送可能であることを示しています。
Off-the-shelf convolutional neural network features achieve outstanding results in many image retrieval tasks. However, their invariance to target data is pre-defined by the network architecture and training data. Existing image retrieval approaches require fine-tuning or modification of pre-trained networks to adapt to variations unique to the target data. In contrast, our method enhances the invariance of off-the-shelf features by aggregating features extracted from images augmented at test-time, with augmentations guided by a policy learned through reinforcement learning. The learned policy assigns different magnitudes and weights to the selected transformations, which are selected from a list of image transformations. Policies are evaluated using a metric learning protocol to learn the optimal policy. The model converges quickly and the cost of each policy iteration is minimal as we propose an off-line caching technique to greatly reduce the computational cost of extracting features from augmented images. Experimental results on large trademark retrieval (METU trademark dataset) and landmark retrieval (ROxford5k and RParis6k scene datasets) tasks show that the learned ensemble of transformations is highly effective for improving performance, and is practical, and transferable.
updated: Thu Aug 12 2021 06:05:48 GMT+0000 (UTC)
published: Wed Feb 05 2020 05:08:41 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト