arXiv reaDer
複雑なポーズでのシングルビューの3Dボディとクロスの再構築
Single-view 3D Body and Cloth Reconstruction under Complex Poses
単一画像からの3D人間形状再構成の最近の進歩は、いわゆる陰関数をモデル化する深いネットワークを活用して、空間内の任意に密集した3Dポイントの占有状態を学習するという印象的な結果を示しています。ただし、PiFuHDのように、このパラダイムに基づく現在のアルゴリズムは、人間の形や衣服の正確な形状を推定できますが、高解像度の入力画像が必要であり、複雑な体のポーズをキャプチャすることはできません。ほとんどのトレーニングと評価は、ニュートラルな体のポーズでカメラの前に立っている人間の1k解像度の画像で実行されます。この論文では、公開されているデータを活用して、既存の陰関数ベースのモデルを拡張し、任意のポーズや手足を自己閉塞する可能性のある人間の画像を処理します。陰関数の表現力は、幾何学と体のポーズの詳細を同時にモデル化するのに十分ではないと主張します。したがって、最初に、入力画像を詳細レベルの低い3D体型にマッピングするが、その複雑さにもかかわらず、基礎となる人間のポーズに正しく適合する陰関数を学習する、粗いものから細かいものへのアプローチを提案します。次に、滑らかな表面と入力画像を条件として、衣服と体の高周波の詳細をエンコードする変位マップを学習します。実験のセクションでは、この粗いものから細かいものへの戦略が、最新の最先端のアプローチと比較して、形状の詳細とポーズの正確さの間の非常に優れたトレードオフを表すことを示します。私たちのコードは公開されます。
Recent advances in 3D human shape reconstruction from single images have shown impressive results, leveraging on deep networks that model the so-called implicit function to learn the occupancy status of arbitrarily dense 3D points in space. However, while current algorithms based on this paradigm, like PiFuHD, are able to estimate accurate geometry of the human shape and clothes, they require high-resolution input images and are not able to capture complex body poses. Most training and evaluation is performed on 1k-resolution images of humans standing in front of the camera under neutral body poses. In this paper, we leverage publicly available data to extend existing implicit function-based models to deal with images of humans that can have arbitrary poses and self-occluded limbs. We argue that the representation power of the implicit function is not sufficient to simultaneously model details of the geometry and of the body pose. We, therefore, propose a coarse-to-fine approach in which we first learn an implicit function that maps the input image to a 3D body shape with a low level of detail, but which correctly fits the underlying human pose, despite its complexity. We then learn a displacement map, conditioned on the smoothed surface and on the input image, which encodes the high-frequency details of the clothes and body. In the experimental section, we show that this coarse-to-fine strategy represents a very good trade-off between shape detail and pose correctness, comparing favorably to the most recent state-of-the-art approaches. Our code will be made publicly available.
updated: Mon May 09 2022 07:34:06 GMT+0000 (UTC)
published: Mon May 09 2022 07:34:06 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト