ASSANet: An Anisotropic Separable Set Abstraction for Efficient Point Cloud Representation Learning
3Dポイントクラウド表現へのアクセスは、さまざまなモバイルデバイスに組み込まれたLiDARセンサーによって広く促進されています。これにより、高速で正確な点群処理技術に対する新たなニーズが生まれています。このホワイトペーパーでは、最も影響力がありながら十分に検討されていないネットワークの1つであるPointNet ++を再検討して深く掘り下げ、モデルのより高速で正確なバリアントを開発します。最初に、PointNet ++で使用されるバニラSAモジュールを(1)学習チャネル相関と(2)学習空間相関の2つの別々の学習段階に解きほぐす新しい分離可能セット抽象化(SA)モジュールを紹介します。 Separable SAモジュールは、バニラバージョンよりも大幅に高速ですが、同等のパフォーマンスを実現します。次に、新しい異方性低減機能を分離可能SAモジュールに導入し、ネットワークの精度を大幅に向上させる異方性分離可能SA(ASSA)モジュールを提案します。その後、PointNet ++のバニラSAモジュールを提案されたASSAモジュールに置き換え、変更されたネットワークをASSANetと表記します。点群分類、セマンティックセグメンテーション、およびパーツセグメンテーションに関する広範な実験により、ASSANetはPointNet ++やその他の方法よりも優れており、はるかに高い精度と高速性を実現していることが示されています。特に、ASSANetは、単一のNVIDIA 2080Ti GPUで1.6倍速い推論速度を維持しながら、S3DISエリア5でPointNet ++を7.4mIoU上回っています。スケーリングされたASSANetバリアントは、66.8 mIoUを達成し、KPConvを上回りますが、54倍以上高速です。
Access to 3D point cloud representations has been widely facilitated by LiDAR sensors embedded in various mobile devices. This has led to an emerging need for fast and accurate point cloud processing techniques. In this paper, we revisit and dive deeper into PointNet++, one of the most influential yet under-explored networks, and develop faster and more accurate variants of the model. We first present a novel Separable Set Abstraction (SA) module that disentangles the vanilla SA module used in PointNet++ into two separate learning stages: (1) learning channel correlation and (2) learning spatial correlation. The Separable SA module is significantly faster than the vanilla version, yet it achieves comparable performance. We then introduce a new Anisotropic Reduction function into our Separable SA module and propose an Anisotropic Separable SA (ASSA) module that substantially increases the network's accuracy. We later replace the vanilla SA modules in PointNet++ with the proposed ASSA module, and denote the modified network as ASSANet. Extensive experiments on point cloud classification, semantic segmentation, and part segmentation show that ASSANet outperforms PointNet++ and other methods, achieving much higher accuracy and faster speeds. In particular, ASSANet outperforms PointNet++ by 7.4 mIoU on S3DIS Area 5, while maintaining 1.6 × faster inference speed on a single NVIDIA 2080Ti GPU. Our scaled ASSANet variant achieves 66.8 mIoU and outperforms KPConv, while being more than 54 × faster.
updated: Sun Oct 24 2021 11:11:23 GMT+0000 (UTC)
published: Wed Oct 20 2021 12:47:42 GMT+0000 (UTC)
