On a cepstrum-based speech detector robust to white noise
 音声信号のケプストラム表現に対する加法性白色雑音の影響を研究します。音声の各ケプストラム係数の分布は、ノイズに強く依存し、ノイズのケプストラム分布と大幅に重なることが示されています。これらの研究に基づいて、重み付きケプストラム係数の合計に等しいスカラー量Vを提案します。これは、ノイズのようなフレームに対して音声を含むフレームを分類することができます。音声フレームとノイズフレームのVの分布は、SNR = 5 dBを超えると十分に分離されており、Vに基づく堅牢な音声検出器の実現可能性を示しています。
We study effects of additive white noise on the cepstral representation of speech signals. Distribution of each individual cepstrum coefficient of speech is shown to depend strongly on noise and to overlap significantly with the cepstrum distribution of noise. Based on these studies, we suggest a scalar quantity, V, equal to the sum of weighted cepstral coefficients, which is able to classify frames containing speech against noise-like frames. The distributions of V for speech and noise frames are reasonably well separated above SNR = 5 dB, demonstrating the feasibility of robust speech detector based on V.
updated: Tue Oct 10 2000 17:33:02 GMT+0000 (UTC)
published: Tue Oct 10 2000 17:33:02 GMT+0000 (UTC)
