法律状态: 全部 已授权 审中
项目申报: 全部 报过 没有报过
8 件在售专利
本发明提供一种音频数据的聚类分类方法及系统,其中方法包括:辅助用户个性化选择音频聚类分类模型训练样本;当选择完成时,利用音频聚类分类模型训练样本,训练神经网络模型,得到音频聚类分类模型;获取待聚类分类的音频数据;利用音频聚类分类模型,对音频数据进行聚类分类,并输出聚类分类结果。本发明的音频数据的聚类分类方法及系统,提供用户个性化选择音频聚类分类模型的音频聚类分类模型训练样本的途经,用户可以结合自身的音频聚类分类预期进行实施,使得利用音频聚类分类模型对音频数据进行聚类分类的聚类分类结果符合用户的音频聚类分类预期,极大程度上提升了用户体验。
📄 2024106001980 📂 G10L25_03 👤 盐城工学院; 盐城工学院技术转移中心有限公司 📅 2024-05-15
¥0.0
语音情感识别装置
发明 已授权
一种语音情感识别装置,所述装置包括:获取单元,适于获取待处理的语音信号;预处理单元,适于对所获取的语音信号进行预处理,得到预处理后的语音信号;参数提取单元,适于提取预处理后的语音信号的特征参数;所述特征参数包括短时能量及其衍生参数、基音频率及其衍生参数、音质特征共振峰及其衍生参数、对MFCC求取的20阶的Mel倒谱系数和MFCC的一阶差分的最大值、MFCC的一阶差分最小值、MFCC的一阶差分的均值和MFCC的一阶差分的方差;采用所提取的特征参数组成对应的特征矢量序列,得到所述语音信号对应的特征矢量序列;识别单元,适于采用支持向量机对所述语音信号对应的特征矢量序列进行训练和识别,得到对应的语音情感识别结果。上述的方案,可以提高语音情感识别的准确率。
📄 2018104551641 📂 G10L25_03 👤 南京邮电大学 📅 2018-05-11
¥0.0
一种语音情感识别方法及装置、计算机可读存储介质、终端,所述方法包括:获取待处理的语音信号;对所获取的语音信号进行预处理,得到预处理后的语音信号;提取预处理后的语音信号的特征参数;所述特征参数包括短时能量及其衍生参数、基音频率及其衍生参数、音质特征共振峰及其衍生参数、对MFCC求取的20阶的Mel倒谱系数和MFCC的一阶差分的最大值、MFCC的一阶差分最小值、MFCC的一阶差分的均值和MFCC的一阶差分的方差;采用所提取的特征参数组成对应的特征矢量序列,得到所述语音信号对应的特征矢量序列;采用支持向量机对所述语音信号对应的特征矢量序列进行训练和识别,得到对应的语音情感识别结果。上述的方案,可以提高语音情感识别的准确率。
📄 2018104551637 📂 G10L25_03 👤 南京邮电大学 📅 2018-05-11
¥0.0
本发明公开了一种基于混合神经网络模型的低通气和呼吸暂停检测识别系统,属于睡眠鼾声检测技术领域;包括:通过多个麦克风采集整晚鼾声数据;对采集到的鼾声数据使用波束形成进行降噪;截取整晚鼾声数据中有效的鼾声数据片段;提取鼾声数据片段的声学特征;通过混合神经网络模型对鼾声特征进行正常鼾声、低通气鼾声和呼吸暂停鼾声的分类;根据分类结果,统计整晚低通气鼾声和呼吸暂停鼾声的数量,计算被测者整晚的睡眠呼吸暂停低通气指数AHI,进一步的,通过AHI指数完成对阻塞性睡眠呼吸暂停低通气综合征OSAHS患者的识别和检测。
📄 2020105706844 📂 G10L25_03 👤 杭州电子科技大学 📅 2020-06-19
¥0.0
本发明公开一种基于transformer模型编码器的语音情感特征提取方法,适用于人工智能和语音情感识别领域。首先利用sincnet滤波器从原始语音波形中提取低级语音情感特征,然后利用多层transformer模型编码器对低级语音情感特征进一步学习;其中改进后的transformer模型编码器为常规transformer模型编码器前添加一层sincnet滤波器,即一组具有带通滤波器的参数化sinc函数,利用sincnet滤波器完成语音原始波形信号的低级特征提取工作,并使网络更好的捕捉重要的窄带情感特征,从而获得更深层次包含全局上下文信息的帧级情感特征。
📄 2020114701159 📂 G10L25_03 👤 江苏师范大学 📅 2020-12-14
¥0.0
本申请涉及一种基于脉冲神经网络的未知音频事件识别算法,它包括如下步骤:构建音频数据集,并拆分为训练集、验证集和测试集;对音频数据集中的每段音频数据进行预处理,生成3D log‑mel频谱图;构建脉冲神经网络模型并进行分类训练;使用交叉熵损失和对比损失联合训所述脉冲神经网络模型;使用验证集中的已知类别的音频数据输入至脉冲神经网络和自编码器,获得区分已知类别和未知音频类别的阈值;使用训练好的脉冲神经网络模型对采集的音频数据进行识别。本发明能够在不依赖于预先标注的未知类别信息的情况下,有效地识别和区分未知的声音事件,提高系统的整体识别的准确率,并为后续的未知声音事件分析和处理提供支持。
📄 2024117647489 📂 G10L25_03 👤 华东交通大学 📅 2024-12-04
¥0.0
本申请公开了一种基于麦克风阵列的雷声信号高效识别方法和系统,属于雷声探测技术领域,包括音频信号采集、音频信号筛选、预处理、模型构建与模型应用五个步骤。本申请采用麦克风阵列实时同步采集多通道环境音频信号,提升了雷声信号的空间表达能力。通过引入基于短时帧平均能量标准差的多通道筛选机制,有效剔除静音段与低动态背景噪声,提升了候选信号的有效性。同时,本发明基于能量与方差加权对多通道特征进行融合,从而增强了神经网络模型对雷声音频事件的判别能力和抗干扰能力。本申请提供的方法适用于复杂环境下的实时雷声识别与监测,具有良好的识别性能和工程应用价值。
📄 2025110976742 📂 G10L25_03 👤 南京信息工程大学 📅 2025-08-06
¥0.0
一种实时语音流监控的方法,公开了对wav语音数字信号流监控时不识别成文字,根据被监测人的语音特征为基础,将预制设定的“关键词”创建、克隆成语音并获取基准声学特征参数;在语音流上以时间间隔较大的周期采集到的语音片段样本,判断非静音后判定为说话语音时;开启多线程分层协调监控的技术步骤,最大化的节省运算资源,实现连续不间断语音流的监控。
📄 2020100627418 📂 G10L25_03 👤 深圳市数字星河科技有限公司 📅 2020-01-20
¥0.0
发明 已授权

一种音频数据的聚类分类方法及系统

2024106001980 · 盐城工学院; 盐城工学院技术转移中心有限公司
¥0.0
发明 已授权

语音情感识别装置

2018104551641 · 南京邮电大学
¥0.0
发明 已授权

语音情感识别方法、计算机可读存储介质、终端

2018104551637 · 南京邮电大学
¥0.0
发明 已授权

基于混合神经网络模型的低通气和呼吸暂停检测识别系统

2020105706844 · 杭州电子科技大学
¥0.0
发明 已授权
发明 已授权

一种基于脉冲神经网络的未知音频事件识别算法

2024117647489 · 华东交通大学
¥0.0
发明 已授权

一种基于麦克风阵列的雷声信号高效识别方法和系统

2025110976742 · 南京信息工程大学
¥0.0
发明 已授权

一种实时语音流监控的方法

2020100627418 · 深圳市数字星河科技有限公司
¥0.0

求购专区 · 发布技术需求,卖家在线应标

🔋 高能量密度固态电解质材料与制备工艺
预算:¥50-100万截止:2026-08-30发布方:××新能源科技响应:8人

交易保障 · 安心交易

资金托管

买家付款至平台,交易完成/过户成功后放款给卖家

权属尽调

专利有效性分析 + 权属状态核查,确保交易安全

合同审核

标准转让/许可合同模板,支持在线电子签署

全程代办

著录项目变更、备案手续全程代办,省心省力

交易流程 · 六步完成专利交易

1
选专利
2
在线沟通
3
签署合同
4
支付款项
5
办理变更
6
过户完成

成功交易案例

🔬

固态锂电池电解质专利包

转让方:中国科学院××研究所
受让方:××新能源科技有限公司
交易类型:独占许可
交易金额:¥320万
🧬

CRISPR基因编辑技术

转让方:××大学
受让方:××生物医药有限公司
交易类型:转让
交易金额:¥1,200万

SiC功率器件工艺专利

转让方:××半导体有限公司
受让方:××汽车电子集团
交易类型:转让
交易金额:¥680万
☀️

钙钛矿光伏组件技术

转让方:××科技公司
受让方:××能源集团
交易类型:开放许可
交易金额:¥50万/年