arXiv reaDer
手書きの文書の転写を改善するための人間の知覚の測定
Measuring Human Perception to Improve Handwritten Document Transcription
視覚科学者が心理物理学を使用して測定した人間の知覚の微妙さは、視覚認識の内部動作への重要な手がかりです。たとえば、測定された反応時間は、被験者が視覚刺激を認識しやすいか、難しいかを示します。この論文では、そのような情報が人間の行動との一貫性を強制できるという仮定の下で、認識タスクのために訓練されているディープニューラルネットワークの損失関数に視覚の心理物理学的測定を組み込む方法を検討します。このアプローチの実行可能性を評価するためのケーススタディとして、手書きの文書の書き起こしの問題を検討します。現代の手書き文字の自動転記に向けて大きな進歩がありましたが、歴史的文書の転記には大きな課題が残っています。ここでは、ディープラーニングベースのドキュメントトランスクリプションシステムのトレーニング体制に適用できる、新しい損失の定式化に基づく一般的な強化戦略について説明します。実験により、3つの異なるネットワークアーキテクチャの標準IAMおよびRIMESデータセットの信頼性の高いパフォーマンスの向上が実証されています。さらに、デジタル化されたラテン語写本の新しいデータセットでのアプローチの実現可能性を示します。これは、9世紀の聖ギャル修道院の書記によって最初に作成されました。
The subtleties of human perception, as measured by vision scientists through the use of psychophysics, are important clues to the internal workings of visual recognition. For instance, measured reaction time can indicate whether a visual stimulus is easy for a subject to recognize, or whether it is hard. In this paper, we consider how to incorporate psychophysical measurements of visual perception into the loss function of a deep neural network being trained for a recognition task, under the assumption that such information can enforce consistency with human behavior. As a case study to assess the viability of this approach, we look at the problem of handwritten document transcription. While good progress has been made towards automatically transcribing modern handwriting, significant challenges remain in transcribing historical documents. Here we describe a general enhancement strategy, underpinned by the new loss formulation, which can be applied to the training regime of any deep learning-based document transcription system. Through experimentation, reliable performance improvement is demonstrated for the standard IAM and RIMES datasets for three different network architectures. Further, we go on to show feasibility for our approach on a new dataset of digitized Latin manuscripts, originally produced by scribes in the Cloister of St. Gall in the the 9th century.
updated: Tue Jun 22 2021 22:00:27 GMT+0000 (UTC)
published: Sun Apr 07 2019 20:23:31 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト