arXiv reaDer
潜在空間中毒を使用した分布外の敵対的攻撃の生成
Generating Out of Distribution Adversarial Attack using Latent Space Poisoning
従来の敵対的攻撃は、ネットワークからの勾配によって生成された摂動に依存しており、一般に勾配誘導検索によって保護されて、ネットワークに敵対的な対応物を提供します。この論文では、実際の画像が破損せず、潜在空間表現を利用して、知覚品質を損なわずに画像の固有の構造を改ざんし、正当なデータサンプルとして機能する敵対的な例を生成する新しいメカニズムを提案します。勾配ベースの攻撃とは対照的に、潜在空間中毒は、分類器の傾向を利用して、トレーニングデータセットの独立した同一の分布をモデル化し、分布サンプルから生成することによってそれをだまします。潜在空間のデータをモデル化するために、もつれを解いた変分オートエンコーダー(beta-VAE)をトレーニングし、次に、クラス条件付き分布関数を使用して、ターゲットラベルに誤って分類されるという制約の下で潜在空間にノイズ摂動を追加します。 MNIST、SVHN、およびCelebAデータセットに関する経験的結果は、生成された敵対的な例が、証明可能な堅牢な防御メカニズムを使用して設計された堅牢なl_0、l_2、l_infノルム分類器を簡単にだますことができることを検証します。
Traditional adversarial attacks rely upon the perturbations generated by gradients from the network which are generally safeguarded by gradient guided search to provide an adversarial counterpart to the network. In this paper, we propose a novel mechanism of generating adversarial examples where the actual image is not corrupted rather its latent space representation is utilized to tamper with the inherent structure of the image while maintaining the perceptual quality intact and to act as legitimate data samples. As opposed to gradient-based attacks, the latent space poisoning exploits the inclination of classifiers to model the independent and identical distribution of the training dataset and tricks it by producing out of distribution samples. We train a disentangled variational autoencoder (beta-VAE) to model the data in latent space and then we add noise perturbations using a class-conditioned distribution function to the latent space under the constraint that it is misclassified to the target label. Our empirical results on MNIST, SVHN, and CelebA dataset validate that the generated adversarial examples can easily fool robust l_0, l_2, l_inf norm classifiers designed using provably robust defense mechanisms.
updated: Wed Dec 09 2020 13:05:44 GMT+0000 (UTC)
published: Wed Dec 09 2020 13:05:44 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト