arXiv reaDer
長期的な視覚的場所認識のための教師あり微調整評価
Supervised Fine-tuning Evaluation for Long-term Visual Place Recognition
この論文では、畳み込み層の後に配置され、視覚的な場所認識のためにエンドツーエンドで微調整された 2 つの最先端のプーリング層を備えたディープ畳み込みニューラル ネットワークの有用性に関する包括的な研究を紹介します。季節や照明の変化など、困難な条件でのタスク。深層学習されたグローバル機能のパフォーマンスを、トリプレット、コントラスト、ArcFace などの 3 つの異なる損失関数と広範囲に比較し、展開中の正しい一致の割合に関してアーキテクチャのパラメーターを学習しました。結果の有効性を検証するために、屋内と屋外の両方で、場所認識に 2 つの実世界のデータセットを利用しました。私たちの調査では、ArcFace 損失をエンド ツー エンドで微調整したアーキテクチャは、特定のしきい値が与えられた場合、視覚的な場所認識タスクについて、屋外で約 1 ~ 4%、屋内データセットで約 1 ~ 2% 他の 2 つの損失よりも優れていることが示されています。
In this paper, we present a comprehensive study on the utility of deep convolutional neural networks with two state-of-the-art pooling layers which are placed after convolutional layers and fine-tuned in an end-to-end manner for visual place recognition task in challenging conditions, including seasonal and illumination variations. We compared extensively the performance of deep learned global features with three different loss functions, e.g. triplet, contrastive and ArcFace, for learning the parameters of the architectures in terms of fraction of the correct matches during deployment. To verify effectiveness of our results, we utilized two real world datasets in place recognition, both indoor and outdoor. Our investigation demonstrates that fine tuning architectures with ArcFace loss in an end-to-end manner outperforms other two losses by approximately 1~4% in outdoor and 1~2% in indoor datasets, given certain thresholds, for the visual place recognition tasks.
updated: Mon Nov 14 2022 19:16:21 GMT+0000 (UTC)
published: Mon Nov 14 2022 19:16:21 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト