arXiv reaDer
A Scalable Approach for Facial Action Unit Classifier Training UsingNoisy Data for Pre-Training
 機械学習システムは、多くの種類の面倒なラベル付けタスクを自動化するために使用されています。顔面アクションコーディングは、膨大な時間と平均レベルを超える人間の専門知識を必要とするラベリングタスクの例です。近年、エンドツーエンドのディープニューラルネットワークの使用により、アクションユニットの認識パフォーマンスが大幅に向上し、多くのネットワークアーキテクチャが提案されています。より複雑なディープニューラルネットワーク(DNN)アーキテクチャは、追加の複雑さを正当化するのに十分なパフォーマンスを発揮しますか?ノイズの多い多様なデータセットの事前トレーニングにより、現在の最先端のDNNアーキテクチャよりも単純なCNNモデルでさえ改善できることを示します。 0.57の以前の最新技術と比較して、0.60です。さらに、事前トレーニングに使用される被験者の数と画像の数がモデルのパフォーマンスにどのように影響するかを示します。概説したアプローチは、オープンソースであり、拡張性が高く、モデルアーキテクチャに依存しません。コードとデータをリリースします:。
Machine learning systems are being used to automate many types of laborious labeling tasks. Facial actioncoding is an example of such a labeling task that requires copious amounts of time and a beyond average level of human domain expertise. In recent years, the use of end-to-end deep neural networks has led to significant improvements in action unit recognition performance and many network architectures have been proposed. Do the more complex deep neural network(DNN) architectures perform sufficiently well to justify the additional complexity? We show that pre-training on a large diverse set of noisy data can result in even a simple CNN model improving over the current state-of-the-art DNN architectures.The average F1-score achieved with our proposed method on the DISFA dataset is 0.60, compared to a previous state-of-the-art of 0.57. Additionally, we show how the number of subjects and number of images used for pre-training impacts the model performance. The approach that we have outlined is open-source, highly scalable, and not dependent on the model architecture. We release the code and data:
updated: Thu Nov 14 2019 05:39:59 GMT+0000 (UTC)
published: Thu Nov 14 2019 05:39:59 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)アソシエイト