多くの実際のデータストリームは、非定常的な方法で頻繁に変化することを意味しますが、ディープラーニング手法のほとんどはトレーニングデータのニューラルネットワークを最適化し、データセットのシフトが発生するとパフォーマンスが大幅に低下します。ただし、人間が新たにストリーミングしたデータに注釈を付けたり検査したりすることは不可能であるため、教師なしで推論時にモデルのドリフトを測定することが望まれます。本論文では、ラベルのないテストデータのバッチ正規化層の統計を活用することにより、モデルドリフト推定の新しい方法を提案します。ストリーミングされた入力データのサンプリングエラーの可能性を修正するために、各表現レイヤーに低ランク近似を採用します。データセットシフトの検出だけでなく、教師なしの方法でモデル動物園またはトレーニング軌跡の間に複数の候補モデルがある場合のモデル選択に対しても、この方法の有効性を示します。さらに、異なるネットワークアーキテクチャ間でモデルのドリフトスコアを比較することにより、メソッドの一貫性を示します。
While many real-world data streams imply that they change frequently in a nonstationary way, most of deep learning methods optimize neural networks on training data, and this leads to severe performance degradation when dataset shift happens. However, it is less possible to annotate or inspect newly streamed data by humans, and thus it is desired to measure model drift at inference time in an unsupervised manner. In this paper, we propose a novel method of model drift estimation by exploiting statistics of batch normalization layer on unlabeled test data. To remedy possible sampling error of streamed input data, we adopt low-rank approximation to each representational layer. We show the effectiveness of our method not only on dataset shift detection but also on model selection when there are multiple candidate models among model zoo or training trajectories in an unsupervised way. We further demonstrate the consistency of our method by comparing model drift scores between different network architectures.