arXiv reaDer
誰もが今署名できますか? 2Dポーズから手話ビデオ生成を探る
Can Everybody Sign Now? Exploring Sign Language Video Generation from 2D Poses
最近の研究では、手話の人間の関節の2D / 3D座標で表される人間のポーズの生成に取り組んでいます。ディープラーニングの最先端のモーション転送を使用し、アメリカ手話データセットであるHow2Signで評価して、2Dポーズスケルトンを指定して手話を実行する署名者のビデオを生成します。生成されたビデオを定量的および定性的に評価し、現在のモデルでは手話の詳細が不足しているため、手話に適したビデオを生成するには不十分であることを示しています。
Recent work have addressed the generation of human poses represented by 2D/3D coordinates of human joints for sign language. We use the state of the art in Deep Learning for motion transfer and evaluate them on How2Sign, an American Sign Language dataset, to generate videos of signers performing sign language given a 2D pose skeleton. We evaluate the generated videos quantitatively and qualitatively showing that the current models are not enough to generated adequate videos for Sign Language due to lack of detail in hands.
updated: Mon Jan 04 2021 14:44:33 GMT+0000 (UTC)
published: Sun Dec 20 2020 14:43:32 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト