arXiv reaDer
LatentFormer:マルチエージェントトランスフォーマーベースの相互作用モデリングと軌道予測
LatentFormer: Multi-Agent Transformer-Based Interaction Modeling and Trajectory Prediction
マルチエージェントの軌道予測は、自動運転の基本的な問題です。予測における重要な課題は、周囲のエージェントの行動を正確に予測し、シーンのコンテキストを理解することです。これらの問題に対処するために、将来の車両軌道を予測するためのトランスベースのモデルであるLatentFormerを提案します。提案された方法は、シーン内の動的オブジェクト間の相互作用をモデル化するための新しい技術を活用します。観察時間中のエージェント間の相互作用をモデル化する多くの既存のアプローチとは対照的に、私たちの方法はさらにエージェントの将来の状態を利用します。これは、エージェントの進化する状態が最終予測における過去の軌道とシーンエンコーディングの寄与を自己回帰的に制御する階層的注意メカニズムを使用して実現されます。さらに、ビジョントランスフォーマーモジュールに依存してローカルシーンとグローバルシーンの両方のコンテキストを効果的にキャプチャし、より許容可能な将来の軌道の生成をガイドするマルチ解像度マップエンコーディングスキームを提案します。 nuScenesベンチマークデータセットで提案された方法を評価し、私たちのアプローチが最先端のパフォーマンスを達成し、軌道メトリックを最大40%向上させることを示します。さらに、広範なアブレーション研究を通じて、提案された手法のさまざまなコンポーネントの寄与を調査します。
Multi-agent trajectory prediction is a fundamental problem in autonomous driving. The key challenges in prediction are accurately anticipating the behavior of surrounding agents and understanding the scene context. To address these problems, we propose LatentFormer, a transformer-based model for predicting future vehicle trajectories. The proposed method leverages a novel technique for modeling interactions among dynamic objects in the scene. Contrary to many existing approaches which model cross-agent interactions during the observation time, our method additionally exploits the future states of the agents. This is accomplished using a hierarchical attention mechanism where the evolving states of the agents autoregressively control the contributions of past trajectories and scene encodings in the final prediction. Furthermore, we propose a multi-resolution map encoding scheme that relies on a vision transformer module to effectively capture both local and global scene context to guide the generation of more admissible future trajectories. We evaluate the proposed method on the nuScenes benchmark dataset and show that our approach achieves state-of-the-art performance and improves upon trajectory metrics by up to 40%. We further investigate the contributions of various components of the proposed technique via extensive ablation studies.
updated: Thu Mar 03 2022 17:44:58 GMT+0000 (UTC)
published: Thu Mar 03 2022 17:44:58 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト