本发明公开了一种基于StarGAN的语音识别模型的防御方法,包括:构建包含生成器、判别器以及分类器的StarGAN模型;构建包括对抗损失函数、分类损失函数,循环一致损失函数的损失函数;以训损失函数最小为目标对StarGAN模型进行训练;语音识别过程中,利用训练好的分类器对原始音频进行分类,当分类结果为正常音频时,直接利用语音识别模型对原始音频进行语音识别,获得语音识别结果;当分类结果不为正常音频时,利用生成器对原始音频生成符合给定的正常音频属性的生成音频,再利用语音识别模型对生成音频进行语音识别,获得语音识别结果。以解决语音识别模型容易受到对抗攻击的问题,进而提高识别精度和鲁棒性。
📄 2020111724854
📂 G10L15_20
👤 浙江工业大学
📅 2020-10-28
本发明公开了一种基于自适应滤波的语音识别装置、方法、设备及介质,包括:采集模块,用于采集说话人的语音信息;预处理模块,用于对语音信息进行模数转换并产生语音信号;第一信号增强模块,用于对语音信号按照基于白噪声的自适应滤波算法进行滤波、降噪并输出第一增强信号及第一增强信号对应的第一信噪比;第二信号增强模块,用于对语音信号按照基于色噪声的自适应滤波算法进行滤波、降噪并输出第二增强信号及第二增强信号对应的第二信噪比;比较输出模块,输出比较结果。本发明考虑了白噪声和色噪声两种噪声的影响,针对性地采用基于白噪声的自适应滤波算法和基于色噪声的自适应滤波算法,提高了语音识别的准确度。
📄 2021104117531
📂 G10L15_20
👤 西南大学
📅 2021-04-16
本发明涉及语音识别技术领域,公开了一种远距离语音识别中去混响方法及系统。该方法包括:模拟室内的声学环境,通过输入的室内空间尺寸,生成不同位置的房间冲击响应序列;对生成的房间冲击响应序列做聚类分析,从而将室内声学环境划分为多个区域,求出每一个区域冲击响应序列的相应补偿矩阵;在构建的识别网络中,用各个区域的补偿矩阵对识别网络进行按帧的补偿,从多个识别结果中利用最大后验概率思想,求出最佳补偿。本发明通过对声学空间进行聚类分析,做到对识别网络有区别性的模型补偿,极大的提高了室内环境中远距离语音识别的抗混响性能。
📄 2013102011025
📂 G10L15_20
👤 重庆邮电大学
📅 2013-05-27
本发明涉及语音交互技术领域,特别涉及一种语音识别方法、交互系统及包括该系统的成绩管理系统,所述方法包括:对获取的语音信号进行语音增强处理;对语音增强处理之后的语音信号进行去噪处理;提取去噪之后语音信号的语音信号;根据语音信号进行判断和处理;将处理后语音信号转换为文字数据,并将文字数据转换为计算机语言;本发明解决噪声对语音识别的影响,提出了小波去造与麦克风阵列相结合的方法,在噪声存在的情况下,提高目标语音的质量和清晰度,消除语音识别系统中待识别语音信号的噪声,提高语音命令识别率。
📄 2020104511478
📂 G10L15_20
👤 重庆邮电大学
📅 2020-05-25
本发明公开了跨语言的实时语音识别拾音方法及系统,涉及语音识别与信号处理技术领域。方法包括:采集语音与VAD数据,结合环境参数进行预加重、分帧及去噪处理。采用线性插值与DTW算法,补偿传输时延。通过声学特征与轻量化CNN网络检测语言,并利用DAN网络将通用特征与语言专属特征映射至统一空间。基于分类噪声类型,动态选择波束形成算法,结合自适应滤波提升信噪比。通过帧级流水线控制延迟,并根据WER、SNR反馈优化拾音参数。通过加权设备状态与处理质量指标评估系统健康度,触发异常处理策略。本系统提升跨语言识别精度与抗噪能力,适用于多语种、高噪声环境下的实时语音交互。
📄 2025113177192
📂 G10L15_20
👤 广州思正电子股份有限公司
📅 2025-09-16