本发明公开一种基于声音诱发脑电信号的说话人识别方法。本发明通过采集脑电数据,提取听觉刺激部分时频特征和时域统计特征的融合特征。采用alpha频段基线校正部分的脑电信号获得的融合特征作为背景模板。将听觉刺激部分融合特征减去背景模板得到干净任务态数据融合特征,最后利用本发明提出的网络模型区分不同说话人。本发明提供了一种可行的基于声音诱发脑电信号的说话人识别方法,并利用训练好的分类器去区分不同说话人,准确率达到90%。
📄 2021102414247
📂 G10L17_00
👤 北京神康云科技有限公司
📅 2021-03-04
本发明公开了一种通话分离方法、装置、计算机设备及存储介质,涉及人工智能领域。该通话分离方法包括:获取原始通话片段;采用静音检测去除原始通话片段中的静音片段,得到第一通话片段;将第一通话片段进行切割,得到至少三个第二通话片段,其中,一个说话人对应一个或多个第二通话片段;获取每个第二通话片段的i‑vector特征,采用预先训练好的双协方差概率线性判别分析模型对每个i‑vector特征进行建模,得到每个第二通话片段的目标模型;基于目标模型,采用变分贝叶斯算法确定相同的说话人的第二通话片段,并将相同的说话人的第二通话片段标记成统一的标签。采用该通话分离方法能够精确分离通话中不同说话人对应的通话片段。
📄 2018113471843
📂 G10L17_00
👤 平安科技(深圳)有限公司
📅 2018-11-13
本发明公开一种深度神经网络模型、电子装置、身份验证方法和存储介质,该方法包括:在收到待进行身份验证的目标用户的当前语音数据后,获取待验证的身份对应的标准语音数据,将这两个标准语音数据分别分帧处理,以得到当前语音帧组和标准语音帧组;利用预设滤波器分别提取出两个语音帧组中的各个语音帧的预设类型声学特征;将提取出的预设类型声学特征输入预先训练好的预设结构深度神经网络模型,以得到当前语音数据和标准语音数据各自对应的预设长度的特征矢量;计算得到的两个特征矢量的余弦相似度,并根据计算出的余弦相似度大小确定身份验证结果。本发明技术方案提升了说话人身份验证的准确性。
📄 2018102251426
📂 G10L17_00
👤 平安科技(深圳)有限公司
📅 2018-03-19
本发明公开一种电子装置、身份验证方法和存储介质,该方法包括:在收到待进行身份验证的目标用户的当前语音数据后,获取待验证的身份对应的标准语音数据,将这两个标准语音数据分别分帧处理,以得到当前语音帧组和标准语音帧组;利用预设滤波器分别提取出两个语音帧组中的各个语音帧的预设类型声学特征;分别将提取出的预设类型声学特征输入预先训练好的预设结构深度神经网络模型,以得到当前语音数据和标准语音数据各自对应的预设长度的特征矢量;计算得到的两个特征矢量的余弦相似度,并根据计算出的余弦相似度大小确定身份验证结果。本发明技术方案提升了说话人身份验证的准确性。
📄 2018102258872
📂 G10L17_00
👤 平安科技(深圳)有限公司
📅 2018-03-19
一种基于人工智能的语音问答验证系统,通过特征辨识模块对语音请求信号进行声纹验证,以产生确认信号并取得某一身分数据,然后语音问答模块从问题数据库中随机选择某一个人问题进行语音提问,当语音提问的结果与内建的答案相符时,对语音请求信号进行语音辨识与语义辨识,以连接对应的云端储存装置,当连接云端储存装置的时间超过预定时间时,依据接收的语音维持信号进行语音解析,进而判断是否与云端储存装置维持连接,用以达成提高身分验证的安全性以及加强云端储存装置的安全性管理的技术功效。
📄 2018105880186
📂 G10L17_00
👤 英业达科技有限公司,英业达股份有限公司
📅 2018-06-08
本发明公开了一种话务系统的声纹识别方法,包括以下步骤:A、电话接入;B、查询用户ID是否声纹注册;如果未注册:通话结束后提取的有效时长大于30秒则进行声纹注册,否则注册失败,如果已注册:则进入验证环节;C、设置切入时间节点;D、话务系统截取部分音频;E、推送声纹服务器;F、返回初步验证结果;G、循环截取部分音频组合推送;H、返回最终验证结果,本发明采用语音流分包推送验证,声纹验证的次数更加多,避免了固定时长单词推送语音质量差导致的误识和误拒;并且采用新的推包的方式,免去核身的等待时间;同时会反馈出一系列的验证得分,可形成直观的验证曲线图表,更具有辨识度、提高用户的使用体验和业务处理效率。
📄 2019107660306
📂 G10L17_00
👤 陈仕云
📅 2019-08-19
已申报项目
本发明公开了一种基于人工智能的音乐教学系统,属于音乐教学技术领域,具体包括:数据库,存储任一目标对象的声纹特征;数据获取模块,实时获取演唱音频;数据分析模块,将演唱音频进行音轨分离,得到演唱人声音频,将人声音频段输入人声分离模型中,得到多个独立演唱音频,采用梅尔频率倒谱变换技术分析处理后的每一帧音频数据并提取音频特征;对任一音频段所包含的多个独立演唱音频数据进行聚类得到若干类别簇;结果生成模块,提取所有噪声类别簇所对应的独立演唱音频并分别带入声纹识别模型中,得到所有不合格目标对象。本发明实现了对合唱训练中不合格对象的精准识别,提高音乐教学的效率和质量。
📄 2024106505963
📂 G10L17_00
👤 莱芜职业技术学院
📅 2024-05-24
本发明涉及老人服务领域,具体涉及一种与老人用户进行连续AI对话的方法及系统,该系统包括:老人说话习惯分析模块和语音解析模块;老人说话习惯分析模块用于根据同一位老人输入的语音信息判断该老人的说话习惯信息,然后将老人的说话习惯信息发送给语音解析模块;语音解析模块接收到语音解析模块发送的老人的说话习惯信息后,根据该老人的说话习惯信息对该老人输入的语音信息按照输入时间先后进行重新组合,然后将组合后的语音信息解析成对应文本信息。与现有技术相比,本方案能够减少解析文本的错误率。
📄 2018108478202
📂 G10L17_00
👤 重庆柚瓣家科技有限公司
📅 2018-07-27
本发明提供基于地面机器人的智能陪护方法,包括接收待识别陪护语音指令、声纹识别、语音识别、确定智能陪护服务内容以及智能陪护。本发明的基于地面机器人的智能陪护方法,整个陪护过程无需陪护人员参与,陪护过程的触发端为接收智能陪护的目标康复病人,基于医疗疗养院中康复病人存在的行动不便,甚至出现的手脚乏力无法动弹的症状,本申请中采用无接触式的陪护语音指令来触发智能陪护,无需目标康复病人做任何肢体动作;通过对语音指令的声纹识别用于区分不同康复病人的声音以及获取对应目标康复病人信息用于指定精准的智能陪护服务内容,实现了对特定康复病人的精准且高质量的陪护,满足了一对一的智能陪护需求。
📄 2021104375675
📂 G10L17_00
👤 苏州知轶信息科技有限公司
📅 2021-04-22
本发明公开了一种指定人群监控方法、装置和存储介质,属于计算机处理领域。方法包括:采集第一终端周围环境的声音,得到第一语音信号;通过第一声音检测模块,检测所述第一语音信号中是否有指定类型的声音,以及通过第一声纹识别模型,检测所述第一语音信号是否为指定用户的声音;当所述第一语音信号为所述指定用户的语音信号,且所述第一语音信号中有指定类型的声音时,向第二终端发送提醒信息。本发明只有检测到指定用户的指定类型的第一语音信号时,才会进行提醒操作,避免了检测到他人指定类型的语音信号造成的误操作,提高了监控的准确性。
📄 2018109255748
📂 G10L17_00
👤 广州高航技术转移有限公司
📅 2018-08-14
本发明涉及一种通道注意力传播与聚合下的声纹识别方法,属于信号处理领域。该方法包括以下步骤:S1:原始语音离散信号的二阶小波散射变换;S2:多尺度特征的声纹映射编码;S3:声纹编码的相似度评估。本发明通过小波散射变换获取多尺度的短时语音特征,采用基于通道注意力传播和聚合的时延神经网络对多尺度特征进行映射得到声纹编码,以提高声纹识别的准确性与鲁棒性。本研究兼顾了长时与短时语音的处理,为含有短时语音数据的声纹识别,提供了新的技术手段,亦可迁移到其他语音处理领域,作为声纹编码的获取方法之一。
📄 2021103686658
📂 G10L17_00
👤 重庆邮电大学
📅 2021-04-06
本发明公开了一种回放语音检测方法,其在训练阶段,先获取语音数据库中的每个语音样本的第一变异系数向量和归一化第一倒谱特征矩阵、第二变异系数向量和归一化第二倒谱特征矩阵,作为四种特征;然后将所有正样本的四种特征分别输入到GMM模型中进行训练,得到四个正样本特征模型,同样获取四个负样本特征模型;在测试阶段,以相同方式获取待检测的语音的四种特征,将每种特征分别输入到对应的正样本特征模型和负样本特征模型中,获得四个似然比得分;根据四个似然比得分得到最终得分,通过比较最终得分与判定阈值,判定是否为回放语音;优点是其检测的等错误概率较低、鲁棒性较强、计算复杂度相对较低,且不仅仅局限于文本相关的声纹认证系统。
📄 2018107452991
📂 G10L17_00
👤 宁波大学
📅 2018-07-09