arXiv reaDer
Q-注意:視覚ベースのロボット操作のための効率的な学習を可能にする
Q-attention: Enabling Efficient Learning for Vision-based Robotic Manipulation
強化学習法の成功にもかかわらず、それらは、広範囲のロボット操作タスクに適用されたとき、まだ画期的な瞬間を持っていません。これは、強化学習アルゴリズムのトレーニングが困難で時間がかかることで有名であるという事実に一部起因しています。これは、フルステート入力ではなく画像からトレーニングする場合に悪化します。人間が操作タスクを実行するとき、私たちの目は、操作されているオブジェクトに順番に焦点を合わせながら、プロセスのすべてのステップを注意深く監視します。これを念頭に置いて、注意駆動型ロボット操作(ARM)アルゴリズムを紹介します。これは、少数のデモンストレーションだけで、さまざまなスパース報酬タスクに適用できる一般的な操作アルゴリズムです。 ARMは、操作の複雑なタスクを3段階のパイプラインに分割します。(1)Q-attentionエージェントは、RGBおよびポイントクラウド入力から関連するピクセル位置を抽出します。(2)Q-attentionエージェントから作物を受け入れる次善のポーズエージェントポーズを出力し、(3)ゴールポーズを取り、共同アクションを出力する制御エージェント。 ARMが成功している間、現在の学習アルゴリズムがさまざまなRLBenchタスクで失敗することを示します。
Despite the success of reinforcement learning methods, they have yet to have their breakthrough moment when applied to a broad range of robotic manipulation tasks. This is partly due to the fact that reinforcement learning algorithms are notoriously difficult and time consuming to train, which is exacerbated when training from images rather than full-state inputs. As humans perform manipulation tasks, our eyes closely monitor every step of the process with our gaze focusing sequentially on the objects being manipulated. With this in mind, we present our Attention-driven Robotic Manipulation (ARM) algorithm, which is a general manipulation algorithm that can be applied to a range of sparse-rewarded tasks, given only a small number of demonstrations. ARM splits the complex task of manipulation into a 3 stage pipeline: (1) a Q-attention agent extracts relevant pixel locations from RGB and point cloud inputs, (2) a next-best pose agent that accepts crops from the Q-attention agent and outputs poses, and (3) a control agent that takes the goal pose and outputs joint actions. We show that current learning algorithms fail on a range of RLBench tasks, whilst ARM is successful.
updated: Fri Feb 04 2022 01:01:14 GMT+0000 (UTC)
published: Mon May 31 2021 09:44:16 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト