arXiv reaDer
方向学習によるワイド ベースラインの相対カメラ ポーズ推定
Wide-Baseline Relative Camera Pose Estimation with Directional Learning
2 つの画像間の相対的なカメラ ポーズを回帰する最新のディープ ラーニング手法では、大きなカメラの動きによってオクルージョンが生じたり、画像間のオーバーラップがほとんど残らない遠近法の大幅な変化など、困難なシナリオに対処することが困難です。これらのモデルは、大規模な教師ありトレーニング データセットの恩恵を受けても、引き続き苦労しています。これらのモデルの制限に対処するために、2D および 3D の回帰キーポイント位置は、キーポイント位置の離散分布を推定することで改善できることを示す手法から着想を得ています。同様に、このペーパーでは、代わりにカメラの姿勢に対する離散分布を予測することにより、カメラの姿勢の回帰を改善することを検討します。このアイデアを実現するために、新しいパラメーター化を使用して 5D 相対姿勢空間上の離散分布を推定し、推定問題を扱いやすくする DirectionNet を導入します。具体的には、DirectionNet は、3D 回転と並進方向によって指定された相対的なカメラ ポーズを 3D 方向ベクトルのセットに因数分解します。 3D 方向は球上の点で識別できるため、DirectionNet は球上の離散分布を出力として推定します。 Matterport3D と InteriorNet から構築された困難な合成および実際の姿勢推定データセットでモデルを評価します。有望な結果は、直接回帰法に比べてエラーが 50% 近く減少することを示しています。
Modern deep learning techniques that regress the relative camera pose between two images have difficulty dealing with challenging scenarios, such as large camera motions resulting in occlusions and significant changes in perspective that leave little overlap between images. These models continue to struggle even with the benefit of large supervised training datasets. To address the limitations of these models, we take inspiration from techniques that show regressing keypoint locations in 2D and 3D can be improved by estimating a discrete distribution over keypoint locations. Analogously, in this paper we explore improving camera pose regression by instead predicting a discrete distribution over camera poses. To realize this idea, we introduce DirectionNet, which estimates discrete distributions over the 5D relative pose space using a novel parameterization to make the estimation problem tractable. Specifically, DirectionNet factorizes relative camera pose, specified by a 3D rotation and a translation direction, into a set of 3D direction vectors. Since 3D directions can be identified with points on the sphere, DirectionNet estimates discrete distributions on the sphere as its output. We evaluate our model on challenging synthetic and real pose estimation datasets constructed from Matterport3D and InteriorNet. Promising results show a near 50% reduction in error over direct regression methods.
updated: Mon Jun 07 2021 04:46:09 GMT+0000 (UTC)
published: Mon Jun 07 2021 04:46:09 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト