arXiv reaDer
視聴覚イベントラインに沿ったポジティブサンプル伝播
Positive Sample Propagation along the Audio-Visual Event Line
多くの場合、視覚信号と音声信号は自然環境で共存し、視聴覚イベント(AVE)を形成します。ビデオを前提として、AVEを含むビデオセグメントをローカライズし、そのカテゴリを特定することを目指しています。分類器の識別機能を学習するには、同期されているかどうかに関係なく、無関係なものを除外しながら、有用な(または肯定的な)視聴覚セグメントのペアを識別することが極めて重要です。この目的のために、すべての可能なペア内の関係を評価することにより、密接に関連するオーディオビジュアルペアを発見して活用するための新しいポジティブサンプル伝播(PSP)モジュールを提案します。これは、各オーディオセグメントとビジュアルセグメントの間にすべてのペアの類似性マップを作成し、類似性スコアが高いペアからの特徴のみを集約することによって実行できます。ネットワークが陽性サンプルの相関性の高い特徴を抽出することを奨励するために、新しい視聴覚ペアの類似性損失が提案されています。また、弱く監視された設定での時間的相関をより有効に活用するために、新しい重み付けブランチを提案します。パブリックAVEデータセットで広範な実験を実行し、完全に監視された設定と弱く監視された設定の両方で新しい最先端の精度を達成し、この方法の有効性を検証します。
Visual and audio signals often coexist in natural environments, forming audio-visual events (AVEs). Given a video, we aim to localize video segments containing an AVE and identify its category. In order to learn discriminative features for a classifier, it is pivotal to identify the helpful (or positive) audio-visual segment pairs while filtering out the irrelevant ones, regardless whether they are synchronized or not. To this end, we propose a new positive sample propagation (PSP) module to discover and exploit the closely related audio-visual pairs by evaluating the relationship within every possible pair. It can be done by constructing an all-pair similarity map between each audio and visual segment, and only aggregating the features from the pairs with high similarity scores. To encourage the network to extract high correlated features for positive samples, a new audio-visual pair similarity loss is proposed. We also propose a new weighting branch to better exploit the temporal correlations in weakly supervised setting. We perform extensive experiments on the public AVE dataset and achieve new state-of-the-art accuracy in both fully and weakly supervised settings, thus verifying the effectiveness of our method.
updated: Mon Apr 05 2021 07:28:13 GMT+0000 (UTC)
published: Thu Apr 01 2021 03:53:57 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト