arXiv reaDer
バランスの取れたオブジェクト検出のための予測の一貫性の調整
Reconcile Prediction Consistency for Balanced Object Detection
分類と回帰は、オブジェクト検出器の2つの柱です。ほとんどのCNNベースの検出器では、これら2つの柱は個別に最適化されています。それらの間の直接的な相互作用がなければ、分類損失と回帰損失は、トレーニングフェーズの最適な方向に向けて同期的に最適化することはできません。これは明らかに、特に不規則な形状とオクルージョンのオブジェクトに対して、高い分類スコアで低いローカリゼーション精度または低い分類スコアであるが高いローカリゼーション精度で多くの一貫性のない予測につながり、NMS後の既存の検出器の検出パフォーマンスを著しく損ないます。バランスの取れたオブジェクト検出のための予測の一貫性を調整するために、分類ブランチとローカリゼーションブランチの最適化を調和させるための高調波損失を提案します。高調波損失により、これら2つのブランチはトレーニング中に相互に監視および促進できるため、推論フェーズでの上位分類とローカリゼーションの高い共起を伴う一貫した予測が生成されます。さらに、トレーニングフェーズ中にローカリゼーション損失が外れ値によって支配されるのを防ぐために、ハーモニックIoU損失を提案して、さまざまなIoUレベルのサンプルのローカリゼーション損失の重みを調和させます。ベンチマークPASCALVOCとMSCOCOに関する包括的な実験は、既存の物体検出器を最先端の精度で容易にするためのモデルの一般性と有効性を示しています。
Classification and regression are two pillars of object detectors. In most CNN-based detectors, these two pillars are optimized independently. Without direct interactions between them, the classification loss and the regression loss can not be optimized synchronously toward the optimal direction in the training phase. This clearly leads to lots of inconsistent predictions with high classification score but low localization accuracy or low classification score but high localization accuracy in the inference phase, especially for the objects of irregular shape and occlusion, which severely hurts the detection performance of existing detectors after NMS. To reconcile prediction consistency for balanced object detection, we propose a Harmonic loss to harmonize the optimization of classification branch and localization branch. The Harmonic loss enables these two branches to supervise and promote each other during training, thereby producing consistent predictions with high co-occurrence of top classification and localization in the inference phase. Furthermore, in order to prevent the localization loss from being dominated by outliers during training phase, a Harmonic IoU loss is proposed to harmonize the weight of the localization loss of different IoU-level samples. Comprehensive experiments on benchmarks PASCAL VOC and MS COCO demonstrate the generality and effectiveness of our model for facilitating existing object detectors to state-of-the-art accuracy.
updated: Tue Aug 24 2021 15:52:11 GMT+0000 (UTC)
published: Tue Aug 24 2021 15:52:11 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト