Image Quality Assessment using Contrastive Learning
自己監視方式で画質表現を取得する問題を検討します。歪みのタイプと程度の予測を補助タスクとして使用して、合成歪みと現実的な歪みの混合を含むラベルのない画像データセットから特徴を学習します。次に、対照的なペアワイズ目的を使用して深い畳み込みニューラルネットワーク(CNN)をトレーニングし、補助問題を解決します。提案されたトレーニングフレームワークとその結果のディープIQAモデルを、CONTRastive Image QUality Evaluator(CONTRIQUE)と呼びます。評価中、CNNの重みは凍結され、線形リグレッサは、学習された表現を参照なし(NR)設定の品質スコアにマッピングします。広範な実験を通じて、CNNバックボーンをさらに微調整しなくても、CONTRIQUEが最先端のNR画質モデルと比較して競争力のあるパフォーマンスを実現することを示しています。学習された表現は非常に堅牢であり、合成または本物の歪みのいずれかによって苦しんでいる画像全体によく一般化されます。私たちの結果は、大きなラベル付きの主観的な画質データセットを必要とせずに、知覚的関連性を備えた強力な品質表現を取得できることを示唆しています。このホワイトペーパーで使用されている実装は、で入手できます。
We consider the problem of obtaining image quality representations in a self-supervised manner. We use prediction of distortion type and degree as an auxiliary task to learn features from an unlabeled image dataset containing a mixture of synthetic and realistic distortions. We then train a deep Convolutional Neural Network (CNN) using a contrastive pairwise objective to solve the auxiliary problem. We refer to the proposed training framework and resulting deep IQA model as the CONTRastive Image QUality Evaluator (CONTRIQUE). During evaluation, the CNN weights are frozen and a linear regressor maps the learned representations to quality scores in a No-Reference (NR) setting. We show through extensive experiments that CONTRIQUE achieves competitive performance when compared to state-of-the-art NR image quality models, even without any additional fine-tuning of the CNN backbone. The learned representations are highly robust and generalize well across images afflicted by either synthetic or authentic distortions. Our results suggest that powerful quality representations with perceptual relevance can be obtained without requiring large labeled subjective image quality datasets. The implementations used in this paper are available at
updated: Mon Oct 25 2021 21:01:00 GMT+0000 (UTC)
published: Mon Oct 25 2021 21:01:00 GMT+0000 (UTC)
