画像分類法の進歩にもかかわらず、トレーニングクラスに属していないサンプルを検出することは依然として困難な問題です。最近、Open-Set Recognition(OSR)と呼ばれるこの主題への関心が爆発的に高まっています。 OSRの目標は、分布外(OOD)サンプルの分類と検出の両方を達成することです。複雑な手法を通じて経験的結果をさらに推し進めるために、いくつかのアイデアが提案されています。そのような複雑さは確かに必要ではないと私たちは信じています。この目的のために、OSRの最も単純なベースラインとしてMaximum Softmax Probability(MSP)を、非OOD拡張でトレーニングされた基本分類子としてVision Transformers(ViT)に適用すると、驚くほど多くの最近の方法を上回ることができることを示しました。非OOD拡張は、データ分散をあまり変更しないものです。私たちの結果は、CIFAR-10データセットの最先端を上回り、SVHNおよびMNISTの現在のほとんどの方法よりも優れています。トレーニングの拡張は、OSRタスクでのViTのパフォーマンスに大きな影響を及ぼし、拡張されたサンプルに大きな多様性をもたらすはずですが、生成されるサンプルのOODネスは制限されたままでなければなりません。
Despite advances in image classification methods, detecting the samples not belonging to the training classes is still a challenging problem. There has been a burst of interest in this subject recently, which is called Open-Set Recognition (OSR). In OSR, the goal is to achieve both the classification and detecting out-of-distribution (OOD) samples. Several ideas have been proposed to push the empirical result further through complicated techniques. We believe that such complication is indeed not necessary. To this end, we have shown that Maximum Softmax Probability (MSP), as the simplest baseline for OSR, applied on Vision Transformers (ViTs) as the base classifier that is trained with non-OOD augmentations can surprisingly outperform many recent methods. Non-OOD augmentations are the ones that do not alter the data distribution by much. Our results outperform state-of-the-art in CIFAR-10 datasets, and is also better than most of the current methods in SVHN and MNIST. We show that training augmentation has a significant effect on the performance of ViTs in the OSR tasks, and while they should produce significant diversity in the augmented samples, the generated sample OOD-ness must remain limited.