arXiv reaDer
ウェーブレットベースのサブバンド分解を使用した画像分類のための構造的に正則化された畳み込みニューラルネットワーク
A Structurally Regularized Convolutional Neural Network for Image Classification using Wavelet-based SubBand Decomposition
ウェーブレットを使用した画像のサブバンド分解に基づく画像分類のための畳み込みニューラルネットワーク(CNN)アーキテクチャを提案します。提案されたアーキテクチャは、入力画像スペクトルを複数の重要にサンプリングされたサブバンドに分解し、サブバンドごとに1つのCNNを使用して特徴を抽出し、最後に、完全に接続されたレイヤーを使用して抽出された特徴を組み合わせることによって分類を実行します。個々のCNNによって各サブバンドを処理し、それによって各CNNの学習範囲を単一のサブバンドに制限すると、構造的な正則化の形式が課せられます。これにより、提示された結果からわかるように、より優れた一般化機能が提供されます。提案されたアーキテクチャは、乗算-加算-アキュムレータ操作の合計に関してクラス最高のパフォーマンスを達成し、必要なパラメータの合計に関してクラス最高のパフォーマンスを達成しますが、競争力のある分類パフォーマンスを維持します。また、提案されたアーキテクチャは、重みとバイアスの量子化および入力量子化によって引き起こされるノイズに対して、通常のフルバンドCNNよりも堅牢であることも示しています。
We propose a convolutional neural network (CNN) architecture for image classification based on subband decomposition of the image using wavelets. The proposed architecture decomposes the input image spectra into multiple critically sampled subbands, extracts features using a single CNN per subband, and finally, performs classification by combining the extracted features using a fully connected layer. Processing each of the subbands by an individual CNN, thereby limiting the learning scope of each CNN to a single subband, imposes a form of structural regularization. This provides better generalization capability as seen by the presented results. The proposed architecture achieves best-in-class performance in terms of total multiply-add-accumulator operations and nearly best-in-class performance in terms of total parameters required, yet it maintains competitive classification performance. We also show the proposed architecture is more robust than the regular full-band CNN to noise caused by weight-and-bias quantization and input quantization.
updated: Tue Mar 02 2021 16:01:22 GMT+0000 (UTC)
published: Tue Mar 02 2021 16:01:22 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト