arXiv reaDer
BGaitR-Net:歩行認識のための時間的に制約されたモデルによる閉塞歩行シーケンスの再構築
BGaitR-Net: Occluded Gait Sequence reconstructionwith temporally constrained model for gait recognition
計算リソースとディープラーニング手法の最近の進歩は、インテリジェントなビジョンベースの監視アプリケーションの開発に大きなメリットをもたらしています。咬合が存在する場合の歩行認識は、この分野での挑戦的な研究トピックの1つであり、これまでに研究者によって提案されたソリューションは、堅牢性に欠け、いくつかの非現実的な制約に依存しているため、実用性が制限されています。入力シーケンス内の閉塞フレームを識別し、次に歩行シーケンスに存在する時空間情報を利用してこれらの閉塞フレームを再構築するための新しい深層学習ベースのアルゴリズムを開発することにより、最先端技術を向上させます。この作業で採用された多段階パイプラインは、キーポーズマッピング、オクルージョンの検出と再構築、そして最後に歩行認識で構成されています。キーポーズマッピングとオクルージョン検出フェーズは、制約付きKMeansクラスタリングを使用し、グラフソートアルゴリズムを介して実行されますが、オクルージョンされたフレームの再構築は、前の手順で導出されたキーポーズ固有の情報と含まれる時空間情報を融合することによって実行されます。双方向の長短期記憶を使用した歩行シーケンスで。このオクルージョン再構成モデルは、合成的にオクルージョンされたCASIA-BおよびOU-ISIRデータを使用してトレーニングされており、トレーニングされたモデルは双方向歩行再構成ネットワークBGait-R-Netと呼ばれます。私たちのLSTMベースのモデルは、閉塞を再構築し、歩行サイクルの周期的パターンと時間的に一致するフレームを生成すると同時に、体の構造を維持します。
Recent advancements in computational resources and Deep Learning methodologies has significantly benefited development of intelligent vision-based surveillance applications. Gait recognition in the presence of occlusion is one of the challenging research topics in this area, and the solutions proposed by researchers to date lack in robustness and also dependent of several unrealistic constraints, which limits their practical applicability. We improve the state-of-the-art by developing novel deep learning-based algorithms to identify the occluded frames in an input sequence and next reconstruct these occluded frames by exploiting the spatio-temporal information present in the gait sequence. The multi-stage pipeline adopted in this work consists of key pose mapping, occlusion detection and reconstruction, and finally gait recognition. While the key pose mapping and occlusion detection phases are done %using Constrained KMeans Clustering and via a graph sorting algorithm, reconstruction of occluded frames is done by fusing the key pose-specific information derived in the previous step along with the spatio-temporal information contained in a gait sequence using a Bi-Directional Long Short Time Memory. This occlusion reconstruction model has been trained using synthetically occluded CASIA-B and OU-ISIR data, and the trained model is termed as Bidirectional Gait Reconstruction Network BGait-R-Net. Our LSTM-based model reconstructs occlusion and generates frames that are temporally consistent with the periodic pattern of a gait cycle, while simultaneously preserving the body structure.
updated: Mon Oct 18 2021 18:28:18 GMT+0000 (UTC)
published: Mon Oct 18 2021 18:28:18 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト