arXiv reaDer
多様なサンプル生成: ジェネレーティブ データフリー量子化の限界を押し広げる
Diverse Sample Generation: Pushing the Limit of Generative Data-free Quantization
ジェネレーティブ データフリー量子化は、実際のデータにアクセスせずにディープ ニューラル ネットワークを低ビット幅に量子化する実用的な圧縮アプローチとして登場しました。このアプローチは、完全精度ネットワークのバッチ正規化 (BN) 統計を利用してデータを生成し、ネットワークを量子化します。ただし、実際には精度の低下という深刻な課題に常に直面しています。最初に、合成サンプルの多様性がデータフリーの量子化にとって重要であるという理論的分析を行いますが、既存のアプローチでは、BN統計によって完全に制約された合成データは、分布およびサンプルレベルで実験的に深刻な均質化を示します。この論文では、有害な均質化を軽減するために、生成的なデータフリー量子化のための一般的な多様なサンプル生成 (DSG) スキームを提示します。最初に、BN レイヤー内のフィーチャの統計アライメントを緩めて、分布の制約を緩和します。次に、さまざまなサンプルの特定の BN レイヤーの損失の影響を強化し、生成プロセスにおけるサンプル間の相関を抑制して、それぞれ統計的および空間的な観点からサンプルを多様化します。包括的な実験により、大規模な画像分類タスクの場合、特に超低ビット幅の下で、DSG がさまざまなニューラル アーキテクチャでパフォーマンスを一貫して量子化できることが示されています。また、DSG によって引き起こされるデータの多様化は、さまざまな量子化を意識したトレーニングおよびトレーニング後の量子化アプローチに一般的な利益をもたらし、その一般性と有効性を示しています。
Generative data-free quantization emerges as a practical compression approach that quantizes deep neural networks to low bit-width without accessing the real data. This approach generates data utilizing batch normalization (BN) statistics of the full-precision networks to quantize the networks. However, it always faces the serious challenges of accuracy degradation in practice. We first give a theoretical analysis that the diversity of synthetic samples is crucial for the data-free quantization, while in existing approaches, the synthetic data completely constrained by BN statistics experimentally exhibit severe homogenization at distribution and sample levels. This paper presents a generic Diverse Sample Generation (DSG) scheme for the generative data-free quantization, to mitigate detrimental homogenization. We first slack the statistics alignment for features in the BN layer to relax the distribution constraint. Then, we strengthen the loss impact of the specific BN layers for different samples and inhibit the correlation among samples in the generation process, to diversify samples from the statistical and spatial perspectives, respectively. Comprehensive experiments show that for large-scale image classification tasks, our DSG can consistently quantization performance on different neural architectures, especially under ultra-low bit-width. And data diversification caused by our DSG brings a general gain to various quantization-aware training and post-training quantization approaches, demonstrating its generality and effectiveness.
updated: Thu Oct 20 2022 07:59:05 GMT+0000 (UTC)
published: Wed Sep 01 2021 07:06:44 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト