arXiv reaDer
DCT表現でのセマンティックセグメンテーションの調査
Exploring Semantic Segmentation on the DCT Representation
 典型的な畳み込みネットワークは、RGBイメージでトレーニングおよび実行されます。ただし、実際のアプリケーションでのメモリ節約と効率的な送信のために、画像はしばしば圧縮されます。この論文では、JPEG規格で定義された離散コサイン変換(DCT)表現でセマンティックセグメンテーションを実行する方法を検討します。最初にDCT係数を再配置して優先入力タイプを形成し、次に既存のネットワークをDCT入力に合わせて調整します。提案された方法は、ほぼ同じネットワーク複雑度でRGBモデルに近い精度を持ちます。さらに、セグメンテーションパフォーマンスに対する異なるDCTコンポーネントの選択の影響を調査します。適切に選択すると、DCT係数のわずか36%を使用して同じレベルの精度を達成できます。さらに、量子化誤差の下での方法の堅牢性を示します。私たちの知る限り、このペーパーはDCT表現のセマンティックセグメンテーションを検討した最初の記事です。
Typical convolutional networks are trained and conducted on RGB images. However, images are often compressed for memory savings and efficient transmission in real-world applications. In this paper, we explore methods for performing semantic segmentation on the discrete cosine transform (DCT) representation defined by the JPEG standard. We first rearrange the DCT coefficients to form a preferred input type, then we tailor an existing network to the DCT inputs. The proposed method has an accuracy close to the RGB model at about the same network complexity. Moreover, we investigate the impact of selecting different DCT components on segmentation performance. With a proper selection, one can achieve the same level accuracy using only 36% of the DCT coefficients. We further show the robustness of our method under the quantization errors. To our knowledge, this paper is the first to explore semantic segmentation on the DCT representation.
updated: Sun Dec 29 2019 07:31:45 GMT+0000 (UTC)
published: Tue Jul 23 2019 17:18:39 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト