構造情報による斜め空中画像シーケンスのオンライン増強は、3Dシーンの解釈と分析のプロセスにおける重要な側面です。これの重要な側面の1つは、効率的な高密度画像マッチングと深度推定です。ここで、Semi-Global Matching(SGM)アプローチは、効率的な深度推定に最も広く使用されているアルゴリズムの1つであることが証明されており、精度と計算の複雑さの間の適切なトレードオフを提供します。ただし、SGMは1次の平滑性の仮定のみをモデル化するため、正面平行面が優先されます。この作業では、効率的な深度と法線マップの推定と、各推定の信頼性測定を可能にする階層的アルゴリズムを提示します。私たちのアルゴリズムは、平面スイープマルチ画像マッチングに依存しており、その後にローカルSGMを組み込むことができる拡張SGM最適化により、斜め空中画像に固有の傾斜面で構成されるエリアでより一貫した正確な推定を実現します。絶対および相対精度測定を使用して、2つの異なるデータセットでアルゴリズムの多数の構成を評価します。評価では、アプローチの結果が、オフライン処理用に設計されたCOLMAPなどの洗練された構造からの動き(SfM)パイプラインによって達成された結果に匹敵することを示しています。ただし、対照的に、このアプローチでは入力シーケンスの限定された画像バンドルのみを考慮しているため、1Hz〜2Hzでオンラインおよびインクリメンタル計算を実行できます。
Online augmentation of an oblique aerial image sequence with structural information is an essential aspect in the process of 3D scene interpretation and analysis. One key aspect in this is the efficient dense image matching and depth estimation. Here, the Semi-Global Matching (SGM) approach has proven to be one of the most widely used algorithms for efficient depth estimation, providing a good trade-off between accuracy and computational complexity. However, SGM only models a first-order smoothness assumption, thus favoring fronto-parallel surfaces. In this work, we present a hierarchical algorithm that allows for efficient depth and normal map estimation together with confidence measures for each estimate. Our algorithm relies on a plane-sweep multi-image matching followed by an extended SGM optimization that allows to incorporate local surface orientations, thus achieving more consistent and accurate estimates in areasmade up of slanted surfaces, inherent to oblique aerial imagery. We evaluate numerous configurations of our algorithm on two different datasets using an absolute and relative accuracy measure. In our evaluation, we show that the results of our approach are comparable to the ones achieved by refined Structure-from-Motion (SfM) pipelines, such as COLMAP, which are designed for offline processing. In contrast, however, our approach only considers a confined image bundle of an input sequence, thus allowing to perform an online and incremental computation at 1Hz-2Hz.