ニューラルネットワークの高い計算コストは、RGB-D顕著なオブジェクト検出(SOD)の最近の成功が実際のアプリケーションに利益をもたらすことを妨げてきました。したがって、この論文では、モバイルネットワークを使用して深い特徴抽出を行う効率的なRGB-DSODに焦点を当てた新しいネットワークMobileSalを紹介します。ただし、モバイルネットワークは、面倒なネットワークほど機能表現が強力ではありません。この目的のために、カラー画像の深度情報は、適切に活用された場合、SODに関連する特徴表現を強化できることを観察します。したがって、RGB-D SODに対するモバイルネットワークの機能表現機能を強化するために、暗黙的な深度復元(IDR)手法を提案します。 IDRはトレーニング段階でのみ採用され、テスト中は省略されるため、計算は不要です。さらに、明確な境界を持つ顕著なオブジェクトを導出するための効率的なマルチレベルの特徴集約のためのコンパクトピラミッドリファインメント(CPR)を提案します。 IDRとCPRが組み込まれているため、MobileSalは、はるかに高速(320×320の入力サイズで450fps)と少ないパラメーター(6.5M)で、6つの挑戦的なRGB-DSODデータセットの最先端の方法に対して有利に機能します。コードはhttps://mmcheng.net/mobilesalでリリースされています。
The high computational cost of neural networks has prevented recent successes in RGB-D salient object detection (SOD) from benefiting real-world applications. Hence, this paper introduces a novel network, MobileSal, which focuses on efficient RGB-D SOD using mobile networks for deep feature extraction. However, mobile networks are less powerful in feature representation than cumbersome networks. To this end, we observe that the depth information of color images can strengthen the feature representation related to SOD if leveraged properly. Therefore, we propose an implicit depth restoration (IDR) technique to strengthen the mobile networks' feature representation capability for RGB-D SOD. IDR is only adopted in the training phase and is omitted during testing, so it is computationally free. Besides, we propose compact pyramid refinement (CPR) for efficient multi-level feature aggregation to derive salient objects with clear boundaries. With IDR and CPR incorporated, MobileSal performs favorably against state-of-the-art methods on six challenging RGB-D SOD datasets with much faster speed (450fps for the input size of 320 × 320) and fewer parameters (6.5M). The code is released at https://mmcheng.net/mobilesal.