期刊简介
《声学学报》(Acta Acustica)由马大猷院士于1964年创办,是中国科学院主管、中国科学院声学研究所主办、中国声学学会和《声学学报》编辑委员会编辑出版的中文学术期刊,刊载具有创造性的声学研究论文、实验性论文和重要应用性论文(包括实验工作、理论和应用研究、仪器研制)。
《声学学报》鼓励作者开展系统深入的创新性研究工作,提炼总结出高质量的学术成果,推动声学领域基础研究和应用研究的发展,促进学术进步和人才成长。
《声学学报》立足国内、面向国际,致力于为科研人员搭建一流的学术交流平台,引领声学学科的发展。
《声学学报》现为双月刊,面向国内外公开发行,ISSN 0371-0025,CN 11-2065/O4,邮发代号2-181。
当前目录
-
- 汉语重音的凸显度分析与合成
- 孟凡博,吴志勇,贾珈,蔡莲红,
- 重音是重要的语调特征,重音合成技术可以提高语音的自然度和表现力。针对重音的局部凸显性,该文提出了声学特征凸显度的表示方法,分析了不同韵律位置(韵律词首、中、尾,韵律短语首、中、尾等)重音音节的声学特征凸显度,发现在韵律单元末(韵律词末音节和韵律短语末韵律词)的重音其基频最大值凸显度要低于非韵律单元末重音,提出了基于声学特征凸显度的非线性的重音声学参数生成算法,解决了传统重音声学参数线性修改算法的修改幅度不足或过大的问题。采用该算法建立了基于隐Markov模型的支持重音合成的语音合成系统。实验表明,该系统可以有效合成带有重音的语音,提高了合成语音的自然度和表现力。
-
- 倒谱本征空间结构化高斯混合模型语音转换方法
- 李阳春,俞一彪,
- 针对非平行语料非联合训练条件下的语音转换,提出一种基于倒谱本征空间结构化高斯混合模型的方法。提取说话人语音倒谱特征参数之后,根据其散布矩阵计算本征向量构造倒谱本征空间并训练结构化高斯混合模型SGMM-ES(Structured Gaussian Mixture Model in Eigen Space)。源和目标说话人各自独立训练的SGMM-ES根据全局声学结构AUS(Acoustical Universal Structure)原理进行匹配对准,最终得到基于倒谱本征空间的短时谱转换函数。实验结果表明,转换语音的目标说话人平均识别率达到95.25%,平均谱失真度为1.25,相对基于原始倒谱特征空间的SGMM方法分别提高了0.8%和7.3%,而ABX和MOS测评表明转换性能非常接近于传统平行语料方法。这一结果说明采用倒谱本征空间结构化高斯混合模型进行非平行语料条件下的语音转换是有效的。
-
- 半监督判别分析的跨库语音情感识别
- 金赟,宋鹏,郑文明,赵力,
- 针对训练样本与测试样本来自不同语音情感数据库造成特征向量空间分布不匹配的问题,采用半监督判别分析减小二者的差异。首先寻找有标签的训练样本和来自另一个库的部分无标签训练样本之间的最优投影方向。基于一致性假设即相近的点更有可能具有相同的类别,利用p近邻图对无标签训练样本相近点之间的关系进行建模,从而获得无标签样本的分布信息。在保证无标签样本间流形结构的同时,使所有训练样本类间散度和类内散度的比值达到最大,从而得到最优的投影方向。采用两组实验进行验证,第1组用eNTERFACE库训练去测试Berlin库,识别率为51.41%,第2组用Berlin库训练测试eNTERFACE库,识别率为45.76%,相比未采用半监督判别分析的识别结果分别有了13.72%和22.81%的提高,说明该算法的有效性。通过实验前后数据的可视化分析,说明利用半监督判别分析确实减小了不同库之间特征向量空间分布的不匹配问题,从而提高跨库语音情感识别率。
-
- 韵律特征在概率线性判别分析说话人确认中的应用
- 梁春燕,杨琳,周若华,颜永红,
- 研究韵律特征在说话人确认中的应用。将整个韵律轨迹以固定段长和段移进行片段划分,并对其进行勒让德多项式拟合从而获取连续性的韵律特征,将特征映射到总变化因子空间,并用概率线性判别分析来补偿说话人和场景的差异。在美国国家标准技术研究院2010年说话人识别评测扩展核心测试集5的基础上加入噪声构造测试集,并分别对韵律特征和传统Mel频率倒谱系数进行测试。结果显示,随着信噪比的逐渐减小,Mel频率倒谱系数性能出现大幅度下降,而韵律特征性能相对比较稳定,两种特征融合后能使系统性能得到进一步提升,等错率和最小检测错误代价相对于Mel频率倒谱系数单系统最多能分别下降9%和11%。实验表明,韵律特征应用于说话人识别中具有较强的噪声鲁棒性,且与传统的Mel频率倒谱系数存在较强的互补性。
-
- 畸变产物耳声发射信号的时域分离算法研究
- 韩晓丽,崔杰,肖灵,
- 针对在分离畸变产物耳声发射(Distortion Product Otoacoustic Emissions,DPOAE)不同产生源成分的过程中两成分之间存在交叉干扰的问题,建立了IFFT(Inverse Fast Fourier Transform,IFFT)结合时域窗的成分分离算法模型,结合模型进行了分离误差的分析,并在此基础上给出一种时间窗窗宽选择准则。根据IFFT后的时域波形,利用两成分主峰包络内的信号波形的矩心移动速率的快慢选择两成分之间的合适的分界点,将两成分分离开。对结合了该时间窗窗宽选择准则的时域成分分离算法进行了仿真,并对DPOAE实验数据进行了成分分离。仿真和实验结果表明,结合该窗宽选择准则的DPOAE时域分离算法可以成功地分离两个成分,且有效地减少了因两成分之间的交叉干扰引入的幅度和相位扰动。因此,结合该窗宽选择准则的DPOAE时域分离算法是有效的,可以提高分离不同产生源成分的准确性。
-
- 常规分裂和非分裂完全匹配层吸收边界比较研究
- 李佩笑,林伟军,张秀梅,王秀明,
- 分别对常规分裂和非分裂完全匹配层吸收边界在完全弹性介质和孔隙介质的应用效果进行了比较研究。比较了两种吸收边界应用于完全弹性介质和孔隙介质所需计算量、存储量大小以及吸收效果。为比较吸收效果,首先给出两种吸收边界下声场快照图的比较,然后利用吸收边界附近的接收点波形,计算和分析了两种吸收边界在固定入射角度处随时间变化的边界反射幅度,以及对不同入射角度声波的边界反射系数。研究结果表明,无论是完全弹性介质还是孔隙介质,常规非分裂完全匹配层吸收边界比分裂完全匹配层吸收边界对垂直入射乃至一般入射角度的声波都有更好的吸收效果,但需要更大的存储量和计算量。
-
- 单层传声器阵列重建相干声场的近场声全息方法研究
- 宋玉来,卢奂采,金江明,李春晓,岳磊,
- 针对传声器阵列两侧存在相干声源的非自由声场重建问题,提出基于球面谐波函数扩展近场声全息理论的相干声场重建方法。该方法在已知测量面两侧声源几何位置时,使用单层传声器阵列获取测量面处的声压分布,通过最小二乘法获得与目标声源和干扰噪声源响应对应的最优球波函数扩展项数和最优系数向量,结合测点位置的空间坐标进行声波分解,并分别重建出各声源在测量面上的声压分布。为了验证方法的有效性,分别给出了相干噪声源为球形声源和非球形声源的仿真验证,并在全消声室内对双扬声器产生的相干声场的重建进行了实验验证。结果表明:该方法对球形声源和非球形声源干扰下的声场重建都具有较好的效果,球形声源干扰下的重建精度更高。
-
- 模糊随机参数二维声场数值计算
- 陈宁,于德介,吕辉,夏百战,
- 解决声场参数同时具有模糊性和随机性的问题,实现模糊随机声场声压响应的预测,引入了信息熵理论,利用信息熵的等效转换,将模糊随机声场转化为纯随机声场或者纯模糊声场进行求解,推导了基于摄动法的二维随机声场和模糊声场的有限元计算公式。以模糊随机参数下的二维管道声场模型和某轿车二维声腔模型为例进行了数值计算,所得结果与蒙特卡洛法(Monte Carlo Method)所预测声压变化范围基本一致,同时,转化为纯随机声场和纯模糊声场所求得声压响应变化范围也基本一致,说明了本文方法计算结果的准确性。因此本文方法能很好地应用于模糊随机参数下二维声场的预测,具有重要的工程应用价值。
-
- 尺度适应模型用于模拟射流流量对空腔压力脉动的抑制
- 余培汛,白俊强,郭博智,韩啸,韩珊珊,
- 空腔气动噪声的抑制对武器舱声学相关难题的解决具有重要意义。采用两方程尺度适应模型的计算流体力学方法对空腔标模进行模拟,通过与国外学者及风洞试验数据的对比,验证了该计算方法的可靠性。基于此,对比分析了不同射流量的射流方式对空腔时均变量,湍动能、压力脉动均方根、声源分布及压力脉动的频域特性的影响,分析可得:射流方式通过改变剪切层的形态来达到影响空腔中的流场形态及压力脉动均方根分布,其中射流构型4(Spout4)能有效降低整个空腔的压力脉动均方根。结果表明:不同射流量对腔内压力脉动及远场噪声的抑制效果不同,且射流量的大小与其抑制效果并不成正比关系。
-
- Rijke管自激热声振荡的数值模拟
- 初敏,徐旭,
- 为了对热声不稳定的发生及控制机理进行研究,对Rijke管内的自激热声振荡现象进行了数值模拟。采用具有低频散低耗散特点的计算气动声学方法,对带有非线性热源项的声波方程进行数值求解,并比较了不同的热源模型及边界条件对非线性效应的影响。结果表明,计算气动声学方法可以成功捕捉到Rijke管内压力的起振过程,而且在速度扰动达到平均流速度的1/3时,振荡会由线性增长转为非线性增长,最终达到有限幅值极限循环。相比热源项,考虑管口辐射耗散的非线性边界条件在振荡幅值和频谱方面对结果的影响都比较小。数值模拟得到的结果与实验符合较好,表明计算气动声学方法适合于热声振荡问题的研究。
