arXiv reaDer
PV-RCNN:3Dオブジェクト検出のためのポイントボクセル機能セットの抽象化
PV-RCNN: Point-Voxel Feature Set Abstraction for 3D Object Detection
点群からの正確な3Dオブジェクト検出のために、PointVoxel-RCNN(PV-RCNN)という名前の新しい高性能3Dオブジェクト検出フレームワークを紹介します。私たちが提案する方法は、3Dボクセル畳み込みニューラルネットワーク(CNN)とPointNetベースの集合の抽象化の両方を深く統合して、より識別力のある点群機能を学習します。これは、3DボクセルCNNの効率的な学習と高品質の提案、およびPointNetベースのネットワークの柔軟な受容野を利用しています。具体的には、提案されたフレームワークは、フォローアップ計算を保存し、代表的なシーンの特徴をエンコードするために、新しいボクセルセット抽象化モジュールを介して3DボクセルCNNを使用して3Dシーンを小さなキーポイントのセットに要約します。ボクセルCNNによって生成された高品質の3Dプロポーザルを前提として、RoIグリッドプーリングは、複数の受容野を使用したキーポイントセットの抽象化を介して、キーポイントからRoIグリッドポイントまでプロポーザル固有の機能を抽象化するために提案されます。従来のプーリング操作と比較して、RoIグリッドの特徴点は、オブジェクトの信頼性と場所を正確に推定するために、はるかに豊富なコンテキスト情報をエンコードします。 KITTIデータセットとWaymoOpenデータセットの両方での広範な実験により、提案されたPV-RCNNは、点群のみを使用することにより、最先端の3D検出方法を大幅に上回っています。コードはhttps://github.com/open-mmlab/OpenPCDetで入手できます。
We present a novel and high-performance 3D object detection framework, named PointVoxel-RCNN (PV-RCNN), for accurate 3D object detection from point clouds. Our proposed method deeply integrates both 3D voxel Convolutional Neural Network (CNN) and PointNet-based set abstraction to learn more discriminative point cloud features. It takes advantages of efficient learning and high-quality proposals of the 3D voxel CNN and the flexible receptive fields of the PointNet-based networks. Specifically, the proposed framework summarizes the 3D scene with a 3D voxel CNN into a small set of keypoints via a novel voxel set abstraction module to save follow-up computations and also to encode representative scene features. Given the high-quality 3D proposals generated by the voxel CNN, the RoI-grid pooling is proposed to abstract proposal-specific features from the keypoints to the RoI-grid points via keypoint set abstraction with multiple receptive fields. Compared with conventional pooling operations, the RoI-grid feature points encode much richer context information for accurately estimating object confidences and locations. Extensive experiments on both the KITTI dataset and the Waymo Open dataset show that our proposed PV-RCNN surpasses state-of-the-art 3D detection methods with remarkable margins by using only point clouds. Code is available at https://github.com/open-mmlab/OpenPCDet.
updated: Fri Apr 09 2021 06:37:15 GMT+0000 (UTC)
published: Tue Dec 31 2019 06:34:10 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト