一种神经网络的语音情感识别方法,包括:步骤1)语音特征MFCC的获取;步骤2)输入本发明中设计的基于神经网络的语音情感识别网络进行语音情感识别;步骤3)获得语音情感识别结果。本发明利用神经网络对语音信号进行情感识别,设计并实现了一个基于神经网络的语音情感识别网络,在进行语音情感识别时,仅需输入待识别的语音信号,即可得到识别的语音情感。对于输入的语音信号,语音情感识别网络能够自适应地提取出其中包含丰富情感信息的语音特征,利用情感特征来进行精确地语音情感识别。该发明对所有人都能进行准确地语音情感识别,具有较大地应用价值。
📄 2022102164528
📂 G10L25_63
👤 浙江工业大学
📅 2022-03-07
一种基于特征融合的语音情感识别方法,包括:步骤1)数据获取与预处理;步骤2)输入本发明中设计的基于特征融合的语音情感识别网络进行情感识别;步骤3)获得情感识别结果。本发明利用分类层特征融合的方法对语音情感进行识别,设计并实现了一种将MFCC(梅尔频率倒谱系数)的深层特征与传统的声学特征相融合的方法,用分类层特征融合算法将MFCC深层特征与过零率、梅尔频率、频谱质心进行融合,通过指定的决策融合规则对输出的识别结果进行融合计算,最后选择概率分布中概率最大的作为识别结果。该发明对语音情感识别,具有较大地应用价值。
📄 202210217251X
📂 G10L25_63
👤 浙江工业大学
📅 2022-03-07
本发明提出一种面向哭声检测系统的Mel能量声纹特征提取方法,本发明的方法基于声纹识别系统中常用的Mel倒谱系数特征,进行深入研究,发现在Mel频谱域,哭声信号Mel能量分布范围以及振荡程度与其他音频信号有较高区分度;为此,针对能量曲线分布范围差异性,提出Mel对数能量波动特征;针对能量曲线振荡差异性,提出Mel对数能量振荡特征。本发明提出的声纹特征提取方法为哭声检测系统提供了性能良好的特征提取解决方案,对哭声检测系统的性能提升有很大帮助。
📄 2018102086753
📂 G10L25_63
👤 南京邮电大学
📅 2018-03-14
本发明公开了一种基于特征集融合的语音情感识别及评价方法,本发明利用Opensmile工具包提取IS09_emotion、IS10_paraling、IS11_speaker_state、IS12_speaker_trait四种语音情感特征集,建立Stacking集成学习模型,通过Stacking的初级学习器融合四种语音特征集,并通过Stacking的次级学习器建立最终的语音情感识别模型。实验结果表明在EMODB和RAVDESS这两种常见的语音数据库上,Stacking集成学习模型不仅关注单个语音情感特征集,同时可以融合不同语音情感特征集,进而达到更好的情感识别效果。
📄 2020105636521
📂 G10L25_63
👤 杭州电子科技大学
📅 2020-06-19
本发明公开了一种结合CGAN谱图去噪和双边滤波谱图增强的语音情感识别方法,包括:S1、获取干净语谱图以及加噪语谱图;S2、将干净语谱图和加噪语谱图输入基于矩阵距离的条件生成对抗网络进行训练,得到去噪模型;S3、利用去噪模型对加噪语谱图进行去噪处理,分别进行两个不同尺度的双边滤波,得到低、高尺度滤波图,低、高尺度滤波图相差再乘以增强系数,然后与低尺度滤波图相加,得到细节增强的语谱图;S4、将细节增强的语谱图输入卷积神经网络模型中进行分类,得到分类模型;S5、待识别语音的语谱图经过步骤S3中对语谱图的处理,得到的细节增强的语谱图输入分类模型,得到语音情感分类结果。本发明有效实现语音情感的识别。
📄 2020112284739
📂 G10L25_63
👤 杭州电子科技大学
📅 2020-11-06
本申请公开了一种音乐情感识别方法、装置、计算机设备及计算机存储介质,涉及人工智能技术领域,可以提高音乐情感识别精度。所述方法包括:从音频样本数据中提取音频特征数据;将所述音频特征数据输入至卷积神经网络进行训练,得到情感分类模型;通过所述情感分类模型将音频特征数据分类为各个情感维度的局部平移不变特征;将所述不同情感维度的局部平移不变特征输入至递归神经网络中进行训练,得到音乐情感识别模型,所述音乐情感识别模型中记录有局部平移不变特征在各个情感维度上的音乐情感识别结果;通过所述音乐情感识别模型对待识别音频数据进行音乐情感识别,得到各个情感维度上的音乐情感识别结果。
📄 201810963057X
📂 G10L25_63
👤 平安科技(深圳)有限公司
📅 2018-08-22
本发明公开一种基于情绪识别的语音质检方法、装置、设备及存储介质。该基于情绪识别的语音质检方法包括:获取待测语音数据;将待测语音数据送入语音情绪识别平台进行情绪识别;将情绪识别结果发送给关联终端,以使关联终端显示情绪识别结果。该基于情绪识别的语音质检方法进行情绪识别时,具有效率高且人工成本低的优点。
📄 201710734303X
📂 G10L25_63
👤 平安科技(深圳)有限公司
📅 2017-08-24
本发明涉及环境模拟控制技术领域,具体为一种基于环境模拟的婴儿床哄睡控制方法及系统,包括以下步骤,采集婴儿哭声信号,设定固定时间窗口,计算相邻帧之间短时能量变化速率和连续音节间隔时间,分析音节间隔时间序列的变动趋势,获取哭声音节节奏变化分析结果。本发明中,通过对哭声信号经过短时分帧处理,计算短时能量变化速率,结合音节边界检测,提取音节间隔时间变化趋势,使情绪波动识别更具实时性,根据音节节奏变化率和能量波动特征分类安抚需求,精准匹配婴儿状态,通过计算相位偏移动态调整摇晃频率,使运动节奏与哭声模式同步,摇晃频率调整后结合嘘嘘声播放与呼吸信号分析,进一步优化环境模拟,提升哄睡过程的稳定性和可靠性。
📄 2025102595895
📂 G10L25_63
👤 重庆逸诺软件开发有限公司
📅 2025-03-06
本申请实施例提供了一种电话语音检测的方法、装置及电子设备,包括:获取来电的电话语音信息;对所述电话语音信息进行检测,得到检测结果,其中,所述检测结果表示所述来电为正常电话或非正常电话;在所述检测结果表示所述来电为非正常电话时,对所述来电执行预设操作。实现了通过电话接通后对电话中语音信息的检测,对上述来电进行判断,若经判断来电为非正常电话,通过预设操作对该来电做进行进一步处理,从而方便用户对来电进行识别和管理。
📄 2019105626654
📂 G10L25_63
👤 杭州海康威视数字技术股份有限公司
📅 2019-06-26
本申请实施例提供了安防报警方法、装置、系统及设备,采集音频流;对上述音频流进行分析,确定上述音频流中是否检测到了目标情绪类型;在上述音频流中检测到了上述目标情绪类型时,向服务器发送报警信息。通过采集音频流实现安防报警,光照因素影响小,能够增加没有光照或者光照不足的情况下安防报警的可靠性。并且通过检测音频流中的目标情绪类型进行报警,相比于检测关键词进行报警的实用性更强,这是因为人在遇到危险时,通常无法正常的进行语音发音,从而导致关键词的识别率大大下降,使得利用关键词进行语音报警的应用变得无效。对语音表达的情绪进行分析,当识别到目标情绪类型时进行报警操作,实际可行性更高。
📄 2019104073042
📂 G10L25_63
👤 杭州海康威视数字技术股份有限公司
📅 2019-05-16
本申请公开了一种监控系统、方法、装置、服务器及存储介质,属于监控技术领域。系统包括:语音采集设备、情感识别服务器和数据管理服务器,语音采集设备,用于采集语音信号,将语音信号和与语音采集设备具有关联关系的用户的身份标识发送给情感识别服务器;情感识别服务器,用于基于身份标识调用用户的所有情感识别模型,每个情感识别模型与用户的一种情感状态对应;基于语音信号,通过调用的情感识别模型确定用户当前的情感状态信息;将确定的情感状态信息发送给数据管理服务器;数据管理服务器,用于对情感状态信息进行管理。该监控系统可以对用户的情感状态进行监控,增加了监控系统的管理性能。
📄 2019102190982
📂 G10L25_63
👤 杭州海康威视数字技术股份有限公司
📅 2019-03-21
本申请提供一种情绪识别的处理方法、装置、设备和存储介质,该方法包括:采集获取用户的语音数据,根据语音数据,获取用户的身份信息以及当前情绪信息,根据身份信息和所述当前情绪信息,获取用户在预设时段内的情绪变化情况,若情绪变化状况指示所述用户的情绪存在风险,则向监护人推送提醒消息,提醒监护人所述用户的情绪存在风险。通过对语音数据的分析,确认用户的身份以及情绪信息,结合一段时间内的情绪信息,可以得到特定用户的情绪变化情况,对情绪识别更精准。
📄 2019105261975
📂 G10L25_63
👤 杭州海康威视数字技术股份有限公司
📅 2019-06-18