arXiv reaDer
音声生成用のリアルタイムMRIビデオの空気組織境界を改善するためのエラー訂正方式
An error correction scheme for improved air-tissue boundary in real-time MRI video for speech production
音声生成におけるリアルタイム磁気共鳴画像法(rtMRI)ビデオの空気組織境界(ATB)セグメンテーションで最高のパフォーマンスは、3次元畳み込みニューラルネットワーク(3D-CNN)モデルによって達成されることが知られています。ただし、このモデルの評価、および文献で報告されている他のATBセグメンテーション手法は、元の輪郭全体と予測された輪郭の間の動的タイムワーピング(DTW)距離を使用して行われます。このような評価尺度では、予測された輪郭の局所的なエラーをキャプチャできない場合があります。予測された輪郭を注意深く分析すると、contour1のvelum部分(上唇、硬口蓋、およびvelumで構成されるATB)やcontour2の舌根部(顎線、下唇、舌根、喉頭蓋を覆うATB)などの領域のエラーが明らかになります。 DTW距離のようなグローバル評価メトリックにはキャプチャされません。この作業では、このようなエラーを自動的に検出し、その修正スキームを提案します。また、これらの輪郭の2種類のエラーを明示的にキャプチャするために、contour1とcontour2で別々にATBセグメンテーションの2つの新しい評価メトリックを提案します。提案された検出および修正戦略により、これら2つの評価メトリックがcontour1では61.8%および61.4%、contour2では67.8%および28.4%向上します。一方、従来のDTW距離は、contour1で44.6%、contour2で4.0%向上します。
The best performance in Air-tissue boundary (ATB) segmentation of real-time Magnetic Resonance Imaging (rtMRI) videos in speech production is known to be achieved by a 3-dimensional convolutional neural network (3D-CNN) model. However, the evaluation of this model, as well as other ATB segmentation techniques reported in the literature, is done using Dynamic Time Warping (DTW) distance between the entire original and predicted contours. Such an evaluation measure may not capture local errors in the predicted contour. Careful analysis of predicted contours reveals errors in regions like the velum part of contour1 (ATB comprising of upper lip, hard palate, and velum) and tongue base section of contour2 (ATB covering jawline, lower lip, tongue base, and epiglottis), which are not captured in a global evaluation metric like DTW distance. In this work, we automatically detect such errors and propose a correction scheme for the same. We also propose two new evaluation metrics for ATB segmentation separately in contour1 and contour2 to explicitly capture two types of errors in these contours. The proposed detection and correction strategies result in an improvement of these two evaluation metrics by 61.8% and 61.4% for contour1 and by 67.8% and 28.4% for contour2. Traditional DTW distance, on the other hand, improves by 44.6% for contour1 and 4.0% for contour2.
updated: Wed Mar 09 2022 03:17:24 GMT+0000 (UTC)
published: Wed Mar 09 2022 03:17:24 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト