arXiv reaDer
手作りの特徴でゼロショットアクション認識の精度を向上させる
Improving Accuracy of Zero-Shot Action Recognition with Handcrafted Features
機械学習の発展に伴い、モデルのデータセットはますます大きくなっています。これは、データ注釈のコストとトレーニング時間の増加につながり、間違いなく機械学習の開発を妨げます。この問題を解決するために、ゼロショット学習が注目されています。ゼロショット学習を使用すると、以前に見たことがなくても、オブジェクトを認識または分類できます。それにもかかわらず、この方法の精度はまだ低く、その実用的なアプリケーションを制限します。この問題を解決するために、手作りの特徴から学習できるビデオテキストマッチングモデルを提案します。私たちのモデルは、単独でアクション クラスを予測するために使用できます。また、精度を向上させるために他のモデルに追加することもできます。さらに、モデルを継続的に最適化して精度を向上させることができます。一部の機能に手動で注釈を付けるだけで済み、人件費が発生します。多くの場合、コストはそれだけの価値があります。 UCF101 と HMDB51 の結果は、モデルが最高の精度を達成し、他のモデルの精度も向上させることを示しています。
With the development of machine learning, datasets for models are getting increasingly larger. This leads to increased data annotation costs and training time, which undoubtedly hinders the development of machine learning. To solve this problem, zero-shot learning is gaining considerable attention. With zero-shot learning, objects can be recognized or classified, even without having been seen before. Nevertheless, the accuracy of this method is still low, thus limiting its practical application. To solve this problem, we propose a video-text matching model, which can learn from handcrafted features. Our model can be used alone to predict the action classes and can also be added to any other model to improve its accuracy. Moreover, our model can be continuously optimized to improve its accuracy. We only need to manually annotate some features, which incurs some labor costs; in many situations, the costs are worth it. The results with UCF101 and HMDB51 show that our model achieves the best accuracy and also improves the accuracies of other models.
updated: Sat Jan 21 2023 03:41:07 GMT+0000 (UTC)
published: Sat Jan 21 2023 03:41:07 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト