FoveaBox: Beyond Anchor-based Object Detector
FoveaBoxは、オブジェクト検出のための正確で柔軟な、完全にアンカーフリーのフレームワークです。ほとんどすべての最新のオブジェクト検出器は、事前定義されたアンカーを使用してオブジェクトの検索に使用可能な位置、スケール、アスペクト比を列挙しますが、そのパフォーマンスと一般化機能もアンカーの設計に制限されます。代わりに、FoveaBoxはオブジェクトの既存の可能性と境界ボックスの座標をアンカー参照なしで直接学習します。これは、(a)オブジェクトが存在する可能性のあるカテゴリ依存のセマンティックマップを予測し、(b)オブジェクトを含む可能性のある位置ごとにカテゴリに依存しない境界ボックスを生成することによって実現されます。ターゲットボックスのスケールは、当然、フィーチャピラミッド表現に関連付けられています。 FoveaBoxでは、インスタンスを隣接する機能レベルに割り当てて、モデルをより正確にします。標準的なベンチマークでその効果を実証し、広範な実験分析を報告します。ベルとホイッスルなしで、FoveaBoxは標準のCOCOおよびPascal VOCオブジェクト検出ベンチマークで最先端の単一モデルのパフォーマンスを実現します。さらに重要なことに、FoveaBoxはアンカーボックスに関連するすべての計算とハイパーパラメーターを回避します。アンカーボックスは、最終的な検出パフォーマンスに影響されることがよくあります。私たちは、シンプルで効果的なアプローチが強固なベースラインとして役立ち、オブジェクト検出の将来の研究を容易にするのに役立つと信じています。コードはで公開されています。
We present FoveaBox, an accurate, flexible, and completely anchor-free framework for object detection. While almost all state-of-the-art object detectors utilize predefined anchors to enumerate possible locations, scales and aspect ratios for the search of the objects, their performance and generalization ability are also limited to the design of anchors. Instead, FoveaBox directly learns the object existing possibility and the bounding box coordinates without anchor reference. This is achieved by: (a) predicting category-sensitive semantic maps for the object existing possibility, and (b) producing category-agnostic bounding box for each position that potentially contains an object. The scales of target boxes are naturally associated with feature pyramid representations. In FoveaBox, an instance is assigned to adjacent feature levels to make the model more accurate.We demonstrate its effectiveness on standard benchmarks and report extensive experimental analysis. Without bells and whistles, FoveaBox achieves state-of-the-art single model performance on the standard COCO and Pascal VOC object detection benchmark. More importantly, FoveaBox avoids all computation and hyper-parameters related to anchor boxes, which are often sensitive to the final detection performance. We believe the simple and effective approach will serve as a solid baseline and help ease future research for object detection. The code has been made publicly available at .
updated: Thu Jul 16 2020 15:38:26 GMT+0000 (UTC)
published: Mon Apr 08 2019 01:43:48 GMT+0000 (UTC)
