arXiv reaDer
Low-Rank Pairwise Alignment Bilinear Network For Few-Shot Fine-Grained Image Classification
 ディープニューラルネットワークは、さまざまな視覚分類タスクで高度な能力を実証しています。これは、注釈付きのグラウンドトゥルースを持つ大規模なトレーニングサンプルに大きく依存しています。ただし、実際のアプリケーションでこのような注釈を要求することは常に非現実的です。最近、トレーニングサンプルの不足に対処する試みとして、Few-Shot Learning(FS)が一般的な分類タスクで大きな進歩を遂げました。それでも、現在のFSモデルでは、トレーニングデータが限られているため、きめの細かいカテゴリ間の微妙な違いを区別することは依然として困難です。この論文では、分類のギャップを埋めるために、困難な数ショット学習設定の下での細粒度分類への取り組みに焦点を当てた、Few-Shot Fine-Grained(FSFG)分類問題に対処します。有効な距離メトリックを学習するためのサポート画像とクエリ画像間の微妙な違いをキャプチャするために、新しい低ランクのペアワイズ双線形プーリング操作が提案されています。さらに、フィーチャアライメントレイヤーは、比較前にサポートイメージフィーチャをクエリフィーチャと一致させるように設計されています。提案されたモデルに低ランクペアワイズアラインメントバイリニアネットワーク(LRPABN)という名前を付けます。これはエンドツーエンドの方法でトレーニングされます。広く使用されている4つの詳細な分類データセットに関する包括的な実験結果は、LRPABNモデルが最先端の方法と比較して優れたパフォーマンスを達成することを示しています。
Deep neural networks have demonstrated advanced abilities on various visual classification tasks, which heavily rely on the large-scale training samples with annotated ground-truth. However, it is unrealistic always to require such annotation in real-world applications. Recently, Few-Shot learning (FS), as an attempt to address the shortage of training samples, has made significant progress in generic classification tasks. Nonetheless, it is still challenging for current FS models to distinguish the subtle differences between fine-grained categories given limited training data. To filling the classification gap, in this paper, we address the Few-Shot Fine-Grained (FSFG) classification problem, which focuses on tackling the fine-grained classification under the challenging few-shot learning setting. A novel low-rank pairwise bilinear pooling operation is proposed to capture the nuanced differences between the support and query images for learning an effective distance metric. Moreover, a feature alignment layer is designed to match the support image features with query ones before the comparison. We name the proposed model Low-Rank Pairwise Alignment Bilinear Network (LRPABN), which is trained in an end-to-end fashion. Comprehensive experimental results on four widely used fine-grained classification datasets demonstrate that our LRPABN model achieves the superior performances compared to state-of-the-art methods.
updated: Thu May 28 2020 03:43:34 GMT+0000 (UTC)
published: Sun Aug 04 2019 10:32:31 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)アソシエイト