オブジェクトが特定のビジョン タスクに属しているかどうかを認識する人間の能力は、すべてのオープン セット認識アルゴリズムよりも優れています。心理学の視覚心理物理学の方法と手順によって測定される人間の知覚は、目新しさを管理する必要があるアルゴリズムに追加のデータ ストリームを提供します。たとえば、人間の被験者から測定された反応時間は、クラス サンプルが別のクラス (既知または新規) と混同される傾向があるかどうかについての洞察を提供できます。この作業では、オブジェクト認識に関連する 200,000 を超える人間の反応時間測定値を収集する大規模な行動実験を設計および実行しました。収集されたデータは、サンプルレベルでオブジェクト間で有意に変化する反応時間を示しました。したがって、さまざまな画像に対して可変の反応時間を示す深いネットワークでの人間の行動との一貫性を強制する、新しい心理物理学的損失関数を設計しました。生物学的視覚の場合と同様に、このアプローチにより、ラベル付けされたトレーニング データが限られているレジームで優れたオープン セット認識パフォーマンスを達成できます。 ImageNet のデータを使用した実験を通じて、この新しい定式化を使用してマルチスケール DenseNet をトレーニングすると、大幅な改善が観察されました。トップ 1 の検証精度が 6.02%、既知のサンプルでのトップ 1 のテスト精度が 9.81%、トップ 1 が大幅に向上しました。未知のサンプルのテスト精度は 33.18% 向上します。私たちの方法を文献からの 10 のオープン セット認識方法と比較しましたが、これらはすべて複数の指標で優れていました。
The human ability to recognize when an object belongs or does not belong to a particular vision task outperforms all open set recognition algorithms. Human perception as measured by the methods and procedures of visual psychophysics from psychology provides an additional data stream for algorithms that need to manage novelty. For instance, measured reaction time from human subjects can offer insight as to whether a class sample is prone to be confused with a different class -- known or novel. In this work, we designed and performed a large-scale behavioral experiment that collected over 200,000 human reaction time measurements associated with object recognition. The data collected indicated reaction time varies meaningfully across objects at the sample-level. We therefore designed a new psychophysical loss function that enforces consistency with human behavior in deep networks which exhibit variable reaction time for different images. As in biological vision, this approach allows us to achieve good open set recognition performance in regimes with limited labeled training data. Through experiments using data from ImageNet, significant improvement is observed when training Multi-Scale DenseNets with this new formulation: it significantly improved top-1 validation accuracy by 6.02%, top-1 test accuracy on known samples by 9.81%, and top-1 test accuracy on unknown samples by 33.18%. We compared our method to 10 open set recognition methods from the literature, which were all outperformed on multiple metrics.