arXiv reaDer
LDRNet:モバイルデバイスでのリアルタイムドキュメントローカリゼーションの有効化
LDRNet: Enabling Real-time Document Localization on Mobile Devices
モバイルデバイスのIDドキュメント検証(IDV)テクノロジは、現代のビジネスオペレーションで広く普及していますが、IDの盗難や詐欺のリスクは高まっています。身分証明書の所有者は通常、詐欺師を回避するためにオンラインビデオインタビューに参加する必要があります。ただし、現在のIDVプロセスは、非効率的で費用のかかるオンラインの段階的なガイダンスをサポートするために、追加の人的労働力に依存しています。既存のAIベースのアプローチのパフォーマンスは、モバイルデバイスのリアルタイムで軽量な要求を満たすことができません。このホワイトペーパーでは、リアルタイムIDVのエッジインテリジェンス支援アプローチを設計することにより、これらの課題に対処します。 IDVプロセスの応答性を向上させることを目的として、モバイルデバイス用の新しいドキュメントローカリゼーションモデルであるLDRNetを提案し、IDドキュメントをリアルタイムでローカライズします。軽量のバックボーンネットワークに基づいて、LDRNetの3つの予測ブランチ、コーナーポイント予測、ライン境界予測、およびドキュメント分類を構築します。新しい補足ターゲットである等分割点を設計し、Line Lossという名前の新しい損失関数を使用して、アプローチの速度と精度を向上させます。 IDVプロセスに加えて、LDRNetは、あらゆる種類のモバイルアプリケーション向けの効率的で信頼性の高いドキュメントローカリゼーションの代替手段です。証拠として、LDRNetのパフォーマンスを、一般的なドキュメントデータセットのローカライズに関する他の一般的なアプローチと比較します。実験結果は、LDRNetが最大790 FPSの速度で動作することを示しています。これは、単一モデルおよび単一スケールのテストで同等のJaccard Index(JI)を達成しながら、47倍高速です。
While Identity Document Verification (IDV) technology on mobile devices becomes ubiquitous in modern business operations, the risk of identity theft and fraud is increasing. The identity document holder is normally required to participate in an online video interview to circumvent impostors. However, the current IDV process depends on an additional human workforce to support online step-by-step guidance which is inefficient and expensive. The performance of existing AI-based approaches cannot meet the real-time and lightweight demands of mobile devices. In this paper, we address those challenges by designing an edge intelligence-assisted approach for real-time IDV. Aiming at improving the responsiveness of the IDV process, we propose a new document localization model for mobile devices, LDRNet, to Localize the identity Document in Real-time. On the basis of a lightweight backbone network, we build three prediction branches for LDRNet, the corner points prediction, the line borders prediction and the document classification. We design novel supplementary targets, the equal-division points, and use a new loss function named Line Loss, to improve the speed and accuracy of our approach. In addition to the IDV process, LDRNet is an efficient and reliable document localization alternative for all kinds of mobile applications. As a matter of proof, we compare the performance of LDRNet with other popular approaches on localizing general document datasets. The experimental results show that LDRNet runs at a speed up to 790 FPS which is 47x faster, while still achieving comparable Jaccard Index(JI) in single-model and single-scale tests.
updated: Thu Oct 13 2022 10:10:51 GMT+0000 (UTC)
published: Sun Jun 05 2022 09:39:12 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト