柿子坊
· 知识产权运营
首页
专利交易
价值评估
13280638997
登录
注册
首页
>
专利交易
>
专利详情
发明专利
已授权
一种多重注意力特征融合的说话人识别方法
📄 申请号:CN202110986397.6
📄 发布日:2026/06/01
著录项目信息
申请日
2021-08-26
公开号
CN113763965A
公开日
2021-12-07
申请人
江苏大学
法律状态
已下证
专利类型
发明
主分类号
G10L17_04
IPC 分类号
G10L17_04
,
G10L17_18
,
G06K9_62
,
技术画像
所属领域
说话人识别
说话人识别
语音信号处理
深度学习
应用场景
身份认证, 智能语音交互, 安防监控, 智能家居, 声纹支付
AI 智能推荐
·
同申请人专利
·
搜索相似专利
摘要
本发明提供了一种多重注意力特征融合的说话人识别方法,构建深度说话人表征模型,包括特征提取器和说话人分类器,Fbank特征作为深度说话人表征模型的输入,通过特征提取器将Fbank特征提取为说话人表征,在训练阶段,使用说话人分类器将说话人表征映射到说话人标签上,并构造损失函数对深度说话人表征模型进行优化;在测试阶段,采用余弦距离比较说话人表征之间的相似度,根据阈值判断是否为相同的说话人。本发明通过多重注意力特征融合对不同分支的特征进行加权融合,多重注意力特征融合包括空间注意力机制和通道注意力机制,增强了每个分支中的有效信息,获得更加鲁棒性的说话人识别性能。
权利要求书 (12项)
说明书
附图
……
……
图1
图2
图3
法律状态时间线
一种新能源汽车电池箱
当前第 / 件
一种多尺度时延采样的单通道语音分离方法
同领域国内专利 · IPC: (G10L17_04)
G10L17_00
G10L17_02
G10L17_04
G10L17_06
G10L17_08
G10L17_12
G10L17_14
G10L17_18
G10L17_22
G10L17_24
G10L17_26
覆盖
11
个领域
相似专利推荐
AI 驱动 · 同领域
一种用于图像数据识别模型构建的方法及系统
¥0.0
2023108217487 · 上海芯翌智能科技有限公司
图像中关键点的检测方法及设备
¥0.0
2020105988342 · 上海芯翌智能科技有限公司
基于图神经网络与元数据的个性化服务推荐方法
¥0.0
2022112333611 · 杭州电子科技大学
¥13000.0
元
不含过户费
委托平台代购
📋 交易方式:
委托待转让
📌 交易状态:
在售
👁️ 浏览次数:46
❤️ 收藏人数:93
📋 项目申报:
未申报
资金托管
权属尽调
包过户
🏢 天津勤熠信息科技有限公司
✓ 企业认证
✓ 手机绑定
历史成交 27件
好评率 98.5%
📊 出价记录 (3条)
王**
¥-10万
李** 企业
¥-8万
陈**
¥-3万
查看全部出价
我要出价 (议价)
预约谈判