arXiv reaDer
インスタンス セグメンテーション モデルの堅牢性のベンチマーク
Benchmarking the Robustness of Instance Segmentation Models
このホワイト ペーパーでは、実世界の画像の破損やドメイン外の画像コレクション (トレーニング データセットとは異なる設定でキャプチャされた画像など) に関するインスタンス セグメンテーション モデルの包括的な評価について説明します。ドメイン外の画像評価は、モデルの一般化機能、現実世界のアプリケーションの重要な側面、およびドメイン適応の広範な研究トピックを示しています。これらの提示された堅牢性と一般化の評価は、実際のアプリケーション用のインスタンス セグメンテーション モデルを設計し、目の前のタスクに直接使用する既製の事前トレーニング済みモデルを選択する際に重要です。具体的には、このベンチマーク調査には、最先端のネットワーク アーキテクチャ、ネットワーク バックボーン、正規化レイヤー、最初からトレーニングされたモデルと事前トレーニング済みのネットワーク、および堅牢性と一般化に対するマルチタスク トレーニングの効果が含まれます。この研究を通じて、私たちはいくつかの洞察を得ることができます。たとえば、グループの正規化は、画像の内容は同じままですが、破損が上に追加される破損全体でネットワークの堅牢性を高めることがわかりました。一方、バッチ正規化は、画像特徴の統計が変化するさまざまなデータセットにわたるモデルの一般化を改善します。また、シングル ステージ検出器は、トレーニング サイズよりも大きな画像解像度にうまく一般化されないこともわかりました。一方、多段検出器は、さまざまなサイズの画像に簡単に使用できます。私たちの包括的な研究が、より堅牢で信頼性の高いインスタンス セグメンテーション モデルの開発を促進することを願っています。
This paper presents a comprehensive evaluation of instance segmentation models with respect to real-world image corruptions as well as out-of-domain image collections, e.g. images captured by a different set-up than the training dataset. The out-of-domain image evaluation shows the generalization capability of models, an essential aspect of real-world applications and an extensively studied topic of domain adaptation. These presented robustness and generalization evaluations are important when designing instance segmentation models for real-world applications and picking an off-the-shelf pretrained model to directly use for the task at hand. Specifically, this benchmark study includes state-of-the-art network architectures, network backbones, normalization layers, models trained starting from scratch versus pretrained networks, and the effect of multi-task training on robustness and generalization. Through this study, we gain several insights. For example, we find that group normalization enhances the robustness of networks across corruptions where the image contents stay the same but corruptions are added on top. On the other hand, batch normalization improves the generalization of the models across different datasets where statistics of image features change. We also find that single-stage detectors do not generalize well to larger image resolutions than their training size. On the other hand, multi-stage detectors can easily be used on images of different sizes. We hope that our comprehensive study will motivate the development of more robust and reliable instance segmentation models.
updated: Wed Aug 10 2022 13:52:51 GMT+0000 (UTC)
published: Thu Sep 02 2021 17:50:07 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト