劣化した書かれた遺産のデジタル復元に関係する研究分野は、その結果を評価するための定量的測定基準を欠いており、大規模なデータセットでの関連する方法の比較を妨げています。したがって、デジタルテキスト復元の分野で定量的評価指標を開発するためのグラウンドトゥルースとして機能する、古代原稿画像の判読性の主観的評価(SALAMI)の新しいデータセットを紹介します。このデータセットは、言語学と古書体学の20人の専門家を対象に実施された調査に基づいた、平均可読性と不確実性の対応する空間マップを備えた50の原稿領域の250の画像で構成されています。この研究はこの種の最初のものであるため、その設計の妥当性と信頼性、および得られた結果は統計的に動機付けられています。評価者内および評価者間の高い合意を報告し、スコアの変動の大部分が参加者およびテスト環境の制御されたまたは制御されていないプロパティによってではなく、観察された領域を画像化します。したがって、測定された読みやすさのスコアは、基になる画像の有効な属性であると結論付けます。
The research field concerned with the digital restoration of degraded written heritage lacks a quantitative metric for evaluating its results, which prevents the comparison of relevant methods on large datasets. Thus, we introduce a novel dataset of Subjective Assessments of Legibility in Ancient Manuscript Images (SALAMI) to serve as a ground truth for the development of quantitative evaluation metrics in the field of digital text restoration. This dataset consists of 250 images of 50 manuscript regions with corresponding spatial maps of mean legibility and uncertainty, which are based on a study conducted with 20 experts of philology and paleography. As this study is the first of its kind, the validity and reliability of its design and the results obtained are motivated statistically: we report a high intra- and inter-rater agreement and show that the bulk of variation in the scores is introduced by the images regions observed and not by controlled or uncontrolled properties of participants and test environments, thus concluding that the legibility scores measured are valid attributes of the underlying images.