语音信号有三个重要的参数:声道数、取样频率和量化位数。
- 声道数:可以是单声道或者是双声道
- 采样频率:一秒内对声音信号的采集次数,44100Hz采样频率意味着每秒钟信号被分解成44100份。换句话说,每隔144100秒就会存储一次,如果采样率高,那么媒体播放音频时会感觉信号是连续的。
- 量化位数:用多少bit表达一次采样所采集的数据,通常有8bit、16bit、24bit和32bit等几种
语音信号是一个非平稳的时变信号
,但语音信号是由声门的激励脉冲通过声道形成
的,而声道(人的口腔、鼻腔)的肌肉运动是缓慢
的,所以“短时间”(10~30ms)
内可以认为语音信号是平稳时不变
的。由此构成了语音信号的“短时分析技术”
。在短时分析中,将语音信号分为一段一段的语音帧,每一帧一般取10~30ms,我们的研究就建立在每一帧的语音特征分析上。提取的不同的语音特征参数对应着不同的语音信号分析方法:时域分析、频域分析、倒谱域分析
…由于语音信号最重要的感知特性反映在功率谱
上,而相位变化只起到很小的作用,所有语音频域分析更加重要。
所谓预加重是指在信号发送之
前</