arXiv reaDer
TCLR:ビデオ表現のための時間的対照学習
TCLR: Temporal Contrastive Learning for Video Representation
対照学習は、画像表現の教師あり学習と自己教師あり学習の間のギャップをほぼ埋めました。ただし、ビデオデータのドメインに対する対照学習の既存の拡張は、ビデオクリップの時間的次元全体の内部の特徴を明示的に表現しようとはしていません。既存の対照的な自己教師ありビデオ表現学習方法を改善するために、2つの新しい損失からなる新しい時間的対照学習フレームワークを開発します。最初の損失は、同じビデオからの重複しないクリップを区別するタスクを追加しますが、2番目の損失は、特徴の時間的多様性を高めるために、入力クリップの特徴マップのタイムステップを区別することを目的としています。時間的対照学習は、アクション認識、限定ラベルアクション分類、複数の3D CNNアーキテクチャにわたるビデオデータセットでの最近傍ビデオ検索などのダウンストリームビデオ理解タスクにおいて、最先端の結果を大幅に改善します。一般的に使用されている3D-ResNet-18アーキテクチャを使用すると、UCF101で82.4%(+ 5.1%増加)、HMDB51アクション分類で52.9%(+ 5.4%増加)、56.2%(+ 11.7%増加)UCF101最近傍ビデオ検索のトップ1リコール。
Contrastive learning has nearly closed the gap between supervised and self-supervised learning of image representations. Existing extensions of contrastive learning to the domain of video data however do not explicitly attempt to represent the internal distinctiveness across the temporal dimension of video clips. We develop a new temporal contrastive learning framework consisting of two novel losses to improve upon existing contrastive self-supervised video representation learning methods. The first loss adds the task of discriminating between non-overlapping clips from the same video, whereas the second loss aims to discriminate between timesteps of the feature map of an input clip in order to increase the temporal diversity of the features. Temporal contrastive learning achieves significant improvement over the state-of-the-art results in downstream video understanding tasks such as action recognition, limited-label action classification, and nearest-neighbor video retrieval on video datasets across multiple 3D CNN architectures. With the commonly used 3D-ResNet-18 architecture, we achieve 82.4% (+5.1% increase over the previous best) top-1 accuracy on UCF101 and 52.9% (+5.4% increase) on HMDB51 action classification, and 56.2% (+11.7% increase) Top-1 Recall on UCF101 nearest neighbor video retrieval.
updated: Thu Feb 04 2021 13:28:27 GMT+0000 (UTC)
published: Wed Jan 20 2021 05:38:16 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト