arXiv reaDer
OLED:ノベルティ検出のための敵対的コンテキストマスキングを備えた1クラスの学習済みエンコーダ-デコーダネットワーク
OLED: One-Class Learned Encoder-Decoder Network with Adversarial Context Masking for Novelty Detection
新規性の検出は、ターゲットクラスの分布に属していないサンプルを認識するタスクです。トレーニング中は、ノベルティクラスが存在しないため、従来の分類アプローチを使用できません。ディープオートエンコーダは、多くの教師なしノベルティ検出方法のベースとして広く使用されています。特に、コンテキストオートエンコーダは、ランダムにマスクされた画像から元の画像を再構築することで学習する表現がより効果的であるため、ノベルティ検出タスクで成功しています。ただし、コンテキストオートエンコーダの重大な欠点は、ランダムマスキングが入力画像の重要な構造を一貫してカバーできず、特に新規性検出タスクの場合、最適ではない表現につながることです。この論文では、入力マスキングを最適化するために、2つの競合するネットワーク(マスクモジュールとリコンストラクタ)で構成されるフレームワークを設計しました。マスクモジュールは、画像の最も重要な部分をカバーする最適なマスクを生成することを学習する畳み込みオートエンコーダです。あるいは、Reconstructorは、マスクされた画像から摂動されていない画像を再構成することを目的とした畳み込みエンコーダ-デコーダです。ネットワークは、マスクモジュールがリコンストラクタに与えられた画像に適用されるマスクを生成するという敵対的な方法でトレーニングされます。このようにして、マスクモジュールは、リコンストラクタが最小化している再構成エラーを最大化しようとします。ノベルティ検出に適用すると、提案されたアプローチは、コンテキストオートエンコーダーと比較して意味的に豊富な表現を学習し、より最適なマスキングを通じてテスト時のノベルティ検出を強化します。 MNISTおよびCIFAR-10画像データセットでの新規性検出実験は、提案されたアプローチが最先端の方法よりも優れていることを示しています。ノベルティ検出のためのUCSDビデオデータセットに関するさらなる実験では、提案されたアプローチは最先端の結果を達成します。
Novelty detection is the task of recognizing samples that do not belong to the distribution of the target class. During training, the novelty class is absent, preventing the use of traditional classification approaches. Deep autoencoders have been widely used as a base of many unsupervised novelty detection methods. In particular, context autoencoders have been successful in the novelty detection task because of the more effective representations they learn by reconstructing original images from randomly masked images. However, a significant drawback of context autoencoders is that random masking fails to consistently cover important structures of the input image, leading to suboptimal representations - especially for the novelty detection task. In this paper, to optimize input masking, we have designed a framework consisting of two competing networks, a Mask Module and a Reconstructor. The Mask Module is a convolutional autoencoder that learns to generate optimal masks that cover the most important parts of images. Alternatively, the Reconstructor is a convolutional encoder-decoder that aims to reconstruct unperturbed images from masked images. The networks are trained in an adversarial manner in which the Mask Module generates masks that are applied to images given to the Reconstructor. In this way, the Mask Module seeks to maximize the reconstruction error that the Reconstructor is minimizing. When applied to novelty detection, the proposed approach learns semantically richer representations compared to context autoencoders and enhances novelty detection at test time through more optimal masking. Novelty detection experiments on the MNIST and CIFAR-10 image datasets demonstrate the proposed approach's superiority over cutting-edge methods. In a further experiment on the UCSD video dataset for novelty detection, the proposed approach achieves state-of-the-art results.
updated: Wed Nov 10 2021 04:14:34 GMT+0000 (UTC)
published: Sat Mar 27 2021 17:59:40 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト