arXiv reaDer
ADAPT: アクション認識運転キャプション トランスフォーマー
ADAPT: Action-aware Driving Caption Transformer
エンドツーエンドの自動運転は、運輸業界で大きな可能性を秘めています。ただし、自動意思決定プロセスの透明性と解釈可能性の欠如は、実際の産業での採用を妨げています。アテンション マップやコスト ボリュームを使用して、一般の乗客には理解しにくいモデルの説明可能性を向上させる初期の試みがいくつかありました。このギャップを埋めるために、エンドツーエンドのトランスフォーマーベースのアーキテクチャである ADAPT (Action-aware Driving cAPtion Transformer) を提案します。これは、自律的な車両制御とアクションの意思決定ステップごとに、ユーザーフレンドリーな自然言語のナレーションと推論を提供します。 ADAPT は、共有ビデオ表現を通じて、運転キャプション タスクと車両制御予測タスクの両方を共同でトレーニングします。 BDD-X (Berkeley DeepDrive eXplanation) データセットの実験では、自動メトリックと人間による評価の両方で ADAPT フレームワークの最先端のパフォーマンスが実証されています。実世界のアプリケーションで提案されたフレームワークの実現可能性を説明するために、生の車のビデオを入力として受け取り、アクションのナレーションと推論をリアルタイムで出力する、新しい展開可能なシステムを構築します。コード、モデル、およびデータは、https://github.com/jxbbb/ADAPT で入手できます。
End-to-end autonomous driving has great potential in the transportation industry. However, the lack of transparency and interpretability of the automatic decision-making process hinders its industrial adoption in practice. There have been some early attempts to use attention maps or cost volume for better model explainability which is difficult for ordinary passengers to understand. To bridge the gap, we propose an end-to-end transformer-based architecture, ADAPT (Action-aware Driving cAPtion Transformer), which provides user-friendly natural language narrations and reasoning for each decision making step of autonomous vehicular control and action. ADAPT jointly trains both the driving caption task and the vehicular control prediction task, through a shared video representation. Experiments on BDD-X (Berkeley DeepDrive eXplanation) dataset demonstrate state-of-the-art performance of the ADAPT framework on both automatic metrics and human evaluation. To illustrate the feasibility of the proposed framework in real-world applications, we build a novel deployable system that takes raw car videos as input and outputs the action narrations and reasoning in real time. The code, models and data are available at https://github.com/jxbbb/ADAPT.
updated: Wed Feb 01 2023 18:59:19 GMT+0000 (UTC)
published: Wed Feb 01 2023 18:59:19 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト