声学学报杂志2015年第1期
-
- 汉语重音的凸显度分析与合成
- 孟凡博,吴志勇,贾珈,蔡莲红,
- 重音是重要的语调特征,重音合成技术可以提高语音的自然度和表现力。针对重音的局部凸显性,该文提出了声学特征凸显度的表示方法,分析了不同韵律位置(韵律词首、中、尾,韵律短语首、中、尾等)重音音节的声学特征凸显度,发现在韵律单元末(韵律词末音节和韵律短语末韵律词)的重音其基频最大值凸显度要低于非韵律单元末重音,提出了基于声学特征凸显度的非线性的重音声学参数生成算法,解决了传统重音声学参数线性修改算法的修改幅度不足或过大的问题。采用该算法建立了基于隐Markov模型的支持重音合成的语音合成系统。实验表明,该系统可以有效合成带有重音的语音,提高了合成语音的自然度和表现力。
-
- 倒谱本征空间结构化高斯混合模型语音转换方法
- 李阳春,俞一彪,
- 针对非平行语料非联合训练条件下的语音转换,提出一种基于倒谱本征空间结构化高斯混合模型的方法。提取说话人语音倒谱特征参数之后,根据其散布矩阵计算本征向量构造倒谱本征空间并训练结构化高斯混合模型SGMM-ES(Structured Gaussian Mixture Model in Eigen Space)。源和目标说话人各自独立训练的SGMM-ES根据全局声学结构AUS(Acoustical Universal Structure)原理进行匹配对准,最终得到基于倒谱本征空间的短时谱转换函数。实验结果表明,转换语音的目标说话人平均识别率达到95.25%,平均谱失真度为1.25,相对基于原始倒谱特征空间的SGMM方法分别提高了0.8%和7.3%,而ABX和MOS测评表明转换性能非常接近于传统平行语料方法。这一结果说明采用倒谱本征空间结构化高斯混合模型进行非平行语料条件下的语音转换是有效的。
-
- 半监督判别分析的跨库语音情感识别
- 金赟,宋鹏,郑文明,赵力,
- 针对训练样本与测试样本来自不同语音情感数据库造成特征向量空间分布不匹配的问题,采用半监督判别分析减小二者的差异。首先寻找有标签的训练样本和来自另一个库的部分无标签训练样本之间的最优投影方向。基于一致性假设即相近的点更有可能具有相同的类别,利用p近邻图对无标签训练样本相近点之间的关系进行建模,从而获得无标签样本的分布信息。在保证无标签样本间流形结构的同时,使所有训练样本类间散度和类内散度的比值达到最大,从而得到最优的投影方向。采用两组实验进行验证,第1组用eNTERFACE库训练去测试Berlin库,识别率为51.41%,第2组用Berlin库训练测试eNTERFACE库,识别率为45.76%,相比未采用半监督判别分析的识别结果分别有了13.72%和22.81%的提高,说明该算法的有效性。通过实验前后数据的可视化分析,说明利用半监督判别分析确实减小了不同库之间特征向量空间分布的不匹配问题,从而提高跨库语音情感识别率。
-
- 韵律特征在概率线性判别分析说话人确认中的应用
- 梁春燕,杨琳,周若华,颜永红,
- 研究韵律特征在说话人确认中的应用。将整个韵律轨迹以固定段长和段移进行片段划分,并对其进行勒让德多项式拟合从而获取连续性的韵律特征,将特征映射到总变化因子空间,并用概率线性判别分析来补偿说话人和场景的差异。在美国国家标准技术研究院2010年说话人识别评测扩展核心测试集5的基础上加入噪声构造测试集,并分别对韵律特征和传统Mel频率倒谱系数进行测试。结果显示,随着信噪比的逐渐减小,Mel频率倒谱系数性能出现大幅度下降,而韵律特征性能相对比较稳定,两种特征融合后能使系统性能得到进一步提升,等错率和最小检测错误代价相对于Mel频率倒谱系数单系统最多能分别下降9%和11%。实验表明,韵律特征应用于说话人识别中具有较强的噪声鲁棒性,且与传统的Mel频率倒谱系数存在较强的互补性。
-
- 畸变产物耳声发射信号的时域分离算法研究
- 韩晓丽,崔杰,肖灵,
- 针对在分离畸变产物耳声发射(Distortion Product Otoacoustic Emissions,DPOAE)不同产生源成分的过程中两成分之间存在交叉干扰的问题,建立了IFFT(Inverse Fast Fourier Transform,IFFT)结合时域窗的成分分离算法模型,结合模型进行了分离误差的分析,并在此基础上给出一种时间窗窗宽选择准则。根据IFFT后的时域波形,利用两成分主峰包络内的信号波形的矩心移动速率的快慢选择两成分之间的合适的分界点,将两成分分离开。对结合了该时间窗窗宽选择准则的时域成分分离算法进行了仿真,并对DPOAE实验数据进行了成分分离。仿真和实验结果表明,结合该窗宽选择准则的DPOAE时域分离算法可以成功地分离两个成分,且有效地减少了因两成分之间的交叉干扰引入的幅度和相位扰动。因此,结合该窗宽选择准则的DPOAE时域分离算法是有效的,可以提高分离不同产生源成分的准确性。
-
- 常规分裂和非分裂完全匹配层吸收边界比较研究
- 李佩笑,林伟军,张秀梅,王秀明,
- 分别对常规分裂和非分裂完全匹配层吸收边界在完全弹性介质和孔隙介质的应用效果进行了比较研究。比较了两种吸收边界应用于完全弹性介质和孔隙介质所需计算量、存储量大小以及吸收效果。为比较吸收效果,首先给出两种吸收边界下声场快照图的比较,然后利用吸收边界附近的接收点波形,计算和分析了两种吸收边界在固定入射角度处随时间变化的边界反射幅度,以及对不同入射角度声波的边界反射系数。研究结果表明,无论是完全弹性介质还是孔隙介质,常规非分裂完全匹配层吸收边界比分裂完全匹配层吸收边界对垂直入射乃至一般入射角度的声波都有更好的吸收效果,但需要更大的存储量和计算量。
-
- 单层传声器阵列重建相干声场的近场声全息方法研究
- 宋玉来,卢奂采,金江明,李春晓,岳磊,
- 针对传声器阵列两侧存在相干声源的非自由声场重建问题,提出基于球面谐波函数扩展近场声全息理论的相干声场重建方法。该方法在已知测量面两侧声源几何位置时,使用单层传声器阵列获取测量面处的声压分布,通过最小二乘法获得与目标声源和干扰噪声源响应对应的最优球波函数扩展项数和最优系数向量,结合测点位置的空间坐标进行声波分解,并分别重建出各声源在测量面上的声压分布。为了验证方法的有效性,分别给出了相干噪声源为球形声源和非球形声源的仿真验证,并在全消声室内对双扬声器产生的相干声场的重建进行了实验验证。结果表明:该方法对球形声源和非球形声源干扰下的声场重建都具有较好的效果,球形声源干扰下的重建精度更高。
-
- 模糊随机参数二维声场数值计算
- 陈宁,于德介,吕辉,夏百战,
- 解决声场参数同时具有模糊性和随机性的问题,实现模糊随机声场声压响应的预测,引入了信息熵理论,利用信息熵的等效转换,将模糊随机声场转化为纯随机声场或者纯模糊声场进行求解,推导了基于摄动法的二维随机声场和模糊声场的有限元计算公式。以模糊随机参数下的二维管道声场模型和某轿车二维声腔模型为例进行了数值计算,所得结果与蒙特卡洛法(Monte Carlo Method)所预测声压变化范围基本一致,同时,转化为纯随机声场和纯模糊声场所求得声压响应变化范围也基本一致,说明了本文方法计算结果的准确性。因此本文方法能很好地应用于模糊随机参数下二维声场的预测,具有重要的工程应用价值。
-
- 尺度适应模型用于模拟射流流量对空腔压力脉动的抑制
- 余培汛,白俊强,郭博智,韩啸,韩珊珊,
- 空腔气动噪声的抑制对武器舱声学相关难题的解决具有重要意义。采用两方程尺度适应模型的计算流体力学方法对空腔标模进行模拟,通过与国外学者及风洞试验数据的对比,验证了该计算方法的可靠性。基于此,对比分析了不同射流量的射流方式对空腔时均变量,湍动能、压力脉动均方根、声源分布及压力脉动的频域特性的影响,分析可得:射流方式通过改变剪切层的形态来达到影响空腔中的流场形态及压力脉动均方根分布,其中射流构型4(Spout4)能有效降低整个空腔的压力脉动均方根。结果表明:不同射流量对腔内压力脉动及远场噪声的抑制效果不同,且射流量的大小与其抑制效果并不成正比关系。
-
- Rijke管自激热声振荡的数值模拟
- 初敏,徐旭,
- 为了对热声不稳定的发生及控制机理进行研究,对Rijke管内的自激热声振荡现象进行了数值模拟。采用具有低频散低耗散特点的计算气动声学方法,对带有非线性热源项的声波方程进行数值求解,并比较了不同的热源模型及边界条件对非线性效应的影响。结果表明,计算气动声学方法可以成功捕捉到Rijke管内压力的起振过程,而且在速度扰动达到平均流速度的1/3时,振荡会由线性增长转为非线性增长,最终达到有限幅值极限循环。相比热源项,考虑管口辐射耗散的非线性边界条件在振荡幅值和频谱方面对结果的影响都比较小。数值模拟得到的结果与实验符合较好,表明计算气动声学方法适合于热声振荡问题的研究。
-
- 传声器阵列对高频弱声源的声成像识别方法
- 钱正莲,杨亦春,余立志,滕鹏晓,韩宝坤,王昌田,
- 研究了传声器阵列对高频弱声源的识别定位方法。该方法根据高频声源的指向性和阵列探测特性等特点,提出了利用信噪比加权方法提高有效阵元对声成像的贡献,根据信噪比的大小对每个阵元添加不同的权值,可以显著提高传声器阵列对高频弱声源的声像清晰度。仿真分析了阵元加权和不加权两种方法对阵列声成像结果的影响,以某型号笔记本电脑电路板噪声为对象进行的实验表明,在阵列测量中充分利用有效阵元信号可以实现对声压级低达10~20dB的微弱噪声源的精确测量。
-
- 识别运动声源随机阵列生成法研究
- 王雁,刘志红,吴波波,仪垂杰,
- 针对随机阵列结构设计方面欠缺高效的生成方法这一问题,在保证阵列对声源识别精度的前提下,提出一种在极坐标下用于识别运动声源的随机阵列生成方法。根据声阵列识别运动声源的原理,推导了非等间距基本同轴圆环的半径,再通过降列分区、极坐标下条件筛选和模拟评价三个步骤,生成适用于识别运动声源的目标随机阵列,最后进行数值模拟和运动汽车噪声源识别实验进行验证。研究结果表明,用该方法能够高效地生成目标随机阵列,与常用规则阵列相比具有更良好的声源识别特性,并且具有准确的运动声源识别性能。
-
- 基于干扰协方差矩阵重构的恒定束宽鲁棒自适应波束形成
- 范展,梁国龙,
- 针对宽带波束形成中的恒定束宽波束响应优化设计问题与鲁棒性问题展开研究。首先,提出一种基于相位补偿的恒定束宽全局优化设计方法,通过对阵列流形向量进行相位补偿来设计恒定束宽波束,与现有的一些方法相比,该方法不仅能获得全局最优解,而且物理实现简单。同时,还提出一种基于协方差矩阵重构的鲁棒自适应宽带波束形成算法。该算法采用Capon估计器估计样本数据的空间一频率谱密度函数,然后对期望信号波达方向之外的角度区间进行积分来重构干扰加噪声协方差矩阵,最后利用重构的协方差矩阵设计自适应波束形成器权系数。该波束形成器设计问题被表述成凸优化问题求解。仿真结果表明,在整个输入信噪比范围内,该算法几乎都能获得接近理想值的输出信干噪比。
-
- 水声无源材料回声降低测量时反聚焦方法
- 李建龙,何志光,闫孝伟,
- 提出了利用时间反转(时反)聚焦技术的水声无源材料回声降低测量方法。首先实现有界水声环境下有、无试样接收信号的时反聚焦,然后利用聚焦信号测量试样反射系数,最后通过标准试样对反射系数进行修正,从而得到试样的回声降低测量值。在小型水池中进行了铝板试样和钢板试样回声降低的测量,铝板试样的尺寸为1.1m×1.0×0.005m,测量频率范围为3~20kHz,钢板试样尺寸与铝板试样相同,测量频率范围为0.5~20kHz,测量结果经修正后与平面波理论计算值基本一致,和理论计算值的相对误差小于10%,扩展不确定度小于1.5dB。本方法采用时反原理实现了接收信号的空时聚焦,提高了测量信混比,因此适用于非自由场环境下无源材料回声降低的测量试验,尤其适用于低频的回声降低测量。
-
- 接近非相干水声通信信道容量的信号处理算法
- 武岩波,朱敏,朱维庆,邢泽平,
- 恶劣情况下的非相干水声通信信道模型为随机相位Rayleigh衰落,推导了该模型的信道容量曲线。为实现接近非相干信道容量的可靠通信,提出多进制低密度校验码(LDPC)和恒重码级联码的多进制非相干概率域迭代处理算法。在信道幅度和相位完全未知的情况下,根据矩估计得到信号和噪声频点幅度的统计参量,进而得到恒重码的码字后验概率,再对多进制LDPC码进行因子图迭代译码。仿真证明本算法与现有的最大能量检测非迭代译码算法相比,与信道容量曲线的差距从4.5dB缩小至1.5dB。给出了实际海试湖试通信效果,频段为6~10kHz,数据速率为357bps,海试时近似垂直通信距离为5km,湖试时水平通信距离近3km、多径超过50mS,两种情况下无差错通信的信噪比门限为2dB,验证了本算法的优势。
中文名称:声学学报
杂志社官网:https://jac.ac.cn/
英文名称:Acta Acustica
语言:中文
类别:物理学
主 编:李晓东
创刊时间:1964
出版周期:双月
国内刊号:11-2065/O4
国际刊号:0371-0025
出版地:北京市
咨询工作人员