arXiv reaDer
ネットワークアーキテクチャと重みの共同適応による効率的な転移学習
Efficient Transfer Learning via Joint Adaptation of Network Architecture and Weight
転移学習は、ソースドメインの知識を活用することにより、ターゲットタスクのパフォーマンスを向上させることができます。ニューラルアーキテクチャ検索(NAS)、特にワンショットNASの最近の研究は、十分なネットワーク検索スペースを確立することにより、転送学習を支援することができます。ただし、既存のNASメソッドは、複数のサブパスを持つ巨大なスーパーネットワークを明示的に構築することで巨大な検索スペースを近似し、子構造が見つかった後にスーパーネットワークの重みを破棄する傾向があります。既存のアプローチの両方の特徴により、転移学習のソースタスクに関する反復的なネットワークトレーニングが発生します。上記の問題を解決するために、より大きな検索スペースを埋め込みながら、ネットワークブロック間の接続をランダムにドロップすることにより、スーパーネットワークのサイズを縮小します。さらに、スーパーネットワークウェイトを使用して、アーキテクチャ転送用のニューラルアーキテクチャ検索モジュールとウェイト転送用のニューラルウェイト検索モジュールの2つのモジュールで構成される新しいフレームワークを提案することにより、冗長なトレーニングを回避しました。これらの2つのモジュールは、削減されたスーパーネットワークに基づいてターゲットタスクの検索を実行するため、ソースタスクを1回トレーニングするだけで済みます。 MS-COCOとCUB-200の両方で、オブジェクト検出ときめ細かい画像分類タスクのフレームワークを実験し、O(CN)スーパーネットワークの複雑さのみで有望な改善を示します。
Transfer learning can boost the performance on the targettask by leveraging the knowledge of the source domain. Recent worksin neural architecture search (NAS), especially one-shot NAS, can aidtransfer learning by establishing sufficient network search space. How-ever, existing NAS methods tend to approximate huge search spaces byexplicitly building giant super-networks with multiple sub-paths, anddiscard super-network weights after a child structure is found. Both thecharacteristics of existing approaches causes repetitive network trainingon source tasks in transfer learning. To remedy the above issues, we re-duce the super-network size by randomly dropping connection betweennetwork blocks while embedding a larger search space. Moreover, wereuse super-network weights to avoid redundant training by proposinga novel framework consisting of two modules, the neural architecturesearch module for architecture transfer and the neural weight searchmodule for weight transfer. These two modules conduct search on thetarget task based on a reduced super-networks, so we only need to trainonce on the source task. We experiment our framework on both MS-COCO and CUB-200 for the object detection and fine-grained imageclassification tasks, and show promising improvements with onlyO(CN)super-network complexity.
updated: Wed May 19 2021 08:58:04 GMT+0000 (UTC)
published: Wed May 19 2021 08:58:04 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト