arXiv reaDer
モダリティバッチ正規化による可視赤外線の再識別の分布ギャップの橋渡し
Bridging the Distribution Gap of Visible-Infrared Person Re-identification with Modality Batch Normalization
可視-赤外線クロスモダリティ人物再識別(VI-ReID)は、可視モダリティと赤外線モダリティの間で人物画像を照合することを目的としており、挑戦的なクロスモダリティ画像検索タスクです。ほとんどの既存の作品は、バッチ正規化レイヤーをニューラルネットワークに統合しますが、バッチ正規化レイヤーは2種類の分布ギャップにつながることがわかりました:1)ミニバッチ間分布ギャップ-各ミニ間の同じモダリティの分布ギャップ-バッチ; 2)ミニバッチ内のモダリティ分布ギャップ-同じミニバッチ内の異なるモダリティの分布ギャップ。これらの問題に対処するために、モダリティバッチ正規化(MBN)と呼ばれる新しいバッチ正規化レイヤーを提案します。これは、ミニバッチ全体ではなく、各モダリティサブミニバッチをそれぞれ正規化し、これらの分布ギャップを大幅に減らすことができます。広範な実験により、MBNは、データセット、バックボーン、損失が異なっていても、VI-ReIDモデルのパフォーマンスを向上させることができることが示されています。
Visible-infrared cross-modality person re-identification (VI-ReID), whose aim is to match person images between visible and infrared modality, is a challenging cross-modality image retrieval task. Most existing works integrate batch normalization layers into their neural network, but we found out that batch normalization layers would lead to two types of distribution gap: 1) inter-mini-batch distribution gap -- the distribution gap of the same modality between each mini-batch; 2) intra-mini-batch modality distribution gap -- the distribution gap of different modality within the same mini-batch. To address these problems, we propose a new batch normalization layer called Modality Batch Normalization (MBN), which normalizes each modality sub-mini-batch respectively instead of the whole mini-batch, and can reduce these distribution gap significantly. Extensive experiments show that our MBN is able to boost the performance of VI-ReID models, even with different datasets, backbones and losses.
updated: Mon Mar 08 2021 14:16:09 GMT+0000 (UTC)
published: Mon Mar 08 2021 14:16:09 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト