arXiv reaDer
3D モデルベースのゼロショット姿勢推定パイプライン
3D Model-based Zero-Shot Pose Estimation Pipeline
既存の学習ベースの姿勢推定手法のほとんどは、通常、非ゼロショット シナリオ向けに開発されており、トレーニング データセット内に存在するオブジェクトの姿勢のみを推定できます。この設定は、トレーニング段階の目に見えないオブジェクトへの適用を制限します。このペーパーでは、オブジェクトの 3D モデルを手がかりとして利用する、完全にゼロショットの姿勢推定パイプラインを紹介します。具体的には、3D モデルベースのゼロショット インスタンス セグメンテーションとゼロショット ポーズ推定器で構成される 2 ステップのパイプラインを設計します。最初のステップでは、テキストの説明ではなく 3D モデルに基づいてゼロショット インスタンス セグメンテーションを実行する新しい方法があり、目に見えないオブジェクトの複雑なプロパティを処理できます。 2 番目のステップでは、階層的な幾何学的構造マッチング メカニズムを利用して、現在のレンダリングベースの方法より 10 倍高速なゼロショット ポーズ推定を実行します。 BOP チャレンジに関する 7 つのコア データセットに関する広範な実験結果は、提案された方法がゼロショットの最先端の方法よりも高速かつ低い計算コストで優れていることを示しています。
Most existing learning-based pose estimation methods are typically developed for non-zero-shot scenarios, where they can only estimate the poses of objects present in the training dataset. This setting restricts their applicability to unseen objects in the training phase. In this paper, we introduce a fully zero-shot pose estimation pipeline that leverages the 3D models of objects as clues. Specifically, we design a two-step pipeline consisting of 3D model-based zero-shot instance segmentation and a zero-shot pose estimator. For the first step, there is a novel way to perform zero-shot instance segmentation based on the 3D models instead of text descriptions, which can handle complex properties of unseen objects. For the second step, we utilize a hierarchical geometric structure matching mechanism to perform zero-shot pose estimation which is 10 times faster than the current render-based method. Extensive experimental results on the seven core datasets on the BOP challenge show that the proposed method outperforms the zero-shot state-of-the-art method with higher speed and lower computation cost.
updated: Mon May 29 2023 07:54:04 GMT+0000 (UTC)
published: Mon May 29 2023 07:54:04 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト