本公开的目的在于提供一种基于混合噪声生成模型的语音训练加噪系统及方法,包括:输入模块、噪声环境增强模块、语音噪声增强模块以及输出模块;其中,输入模块用于获取噪声环境简易描述信息和待增强的干净语音数据;噪声环境增强模块将噪声环境简易描述信息转化为带时序特征的结构化噪声事件序列;语音噪声增强模块根据所述噪声事件序列生成多源混合噪声,并将所述多源混合噪声按预设规则添加至所述干净语音数据,得到带噪语音数据;输出模块用于输出所述带噪语音数据,供语音模型训练使用。本公开充分衔接不同噪声源在时间维度上的叠加、抵消、干涉等交互特征,解决了传统混合方式仅能实现线性叠加的技术瓶颈。
📄 2026102136973
📂 G10L15_06
👤 广东工业大学
📅 2026-02-13
本发明公开了一种基于FPGA的同态加密硬件加速器,包括FPGA端,FPGA端包括数据传输模块、控制模块、同态加密模块、同态解密模块、数论变换模块和小变大模数转换模块;数据传输模块用于实现FPGA端与上位机之间的数据传输;控制模块用于根据加密或解密操作控制数据在各个模块之间的流向;数论变换模块用于对输入的数据进行数论变换或逆数论变换得到变换后的数据或逆数论变换后的数据;同态加密模块用于对经过变换后的数据进行加密得到密文数据;同态解密模块用于对经过变换后的数据进行解密得到明文数据;小变大模数转换模块用于将多路小位宽模数的密文数据或明文数据转换为一路大位宽模数的数据。提高了同态加解密的计算效率。
📄 2025101092140
📂 G06F21_72
👤 重庆邮电大学
📅 2025-01-23
本申请涉及数据采集设备技术领域,且公开了一种语音录入设备的清尘组件,包括语音录入设备本体和活动片,活动片位于语音录入设备本体的一侧,活动片的顶端粘接有连接块,语音录入设备本体正面侧其中一个边角处粘接有第一固定轴,连接块活动套设在第一固定轴的外表面。本方案通过拨动活动片以第一固定轴为轴心进行往复摆动,而活动片在摆动的过程中带动两个毛刷和三个风扇摆动,两个毛刷可将语音录入设备本体正面侧话筒的孔中附着的灰尘进行清扫,同时三个风扇则会将清扫移动过程中的灰尘从话筒的孔中吸出。
📄 2023211533729
📂 B08B1_00
👤 安徽智信大数据科技有限公司
📅 2023-05-15
本发明公开了一种用于语音识别系统的后门安全性评估方法、装置及介质,属于人工智能技术领域。方法包括:根据已有训练好的语音合成模型计算得到优化损失函数,优化生成宿主样本及其语音风格参数,并组成宿主样本集;将触发器注入所述宿主样本集中,组合生成中毒样本集,并与原始训练样本集组合生成混合训练样本集;将已有干净语音训练模型在混合训练样本集中进行标准化训练,生成受害者模型;将干净测试样本以及带有隐形触发器的测试样本分别输入到受害者模型;根据精度测试及后门攻击的结果对受害者模型进行安全性评估。本发明通过语音合成、反向梯度优化及设定目标损失函数的方式,保证了后门攻击下良性训练样本的易获取及标签干净。
📄 2024103490472
📂 H04L9_40
👤 南京邮电大学
📅 2024-03-26
本发明公开了一种基于神经网络和特征融合的合成语音检测方法,所述方法包括:获取音频待测数据集,对音频待测数据集提取音频的声学特征和对应的频谱图图像特征;将音频的声学特征和对应的频谱图图像特征输入预先训练的合成音频检测模型中,分别得到音频的真实性分数一和音频的真实性分数二;将音频的真实性分数一和音频的真实性分数二加权融合,得到特征信息融合后的音频真实性得分;将得到的特征信息融合后的真实性得分与预先设定的阈值比较得到最终音频检测结果;本发明巧妙融合了声学特征和频谱图图像信息进行合成语音检测,具有更好的稳定性和泛化能力。
📄 202311490667X
📂 G10L25_30
👤 南京邮电大学
📅 2023-11-09
本发明提出了一种基于多领域统计特征和改进CNN的含噪语音情感识别方法,属于语音识别领域,包括以下步骤:步骤1:首先对语料库中的纯净语音进行加噪处理,其次提取语音信号的相关多领域特征,采用统计函数对已提取的特征进行筛选,降低特征冗余度,得到冗余度低、情感区分度高的多领域统计特征;步骤2:搭建基于语音增强联合约束CNN‑DNN的框架;步骤3:将多领域统计特征作为系统模型的输入,提取与情感分类标签高度相关且对噪声具有鲁棒性的信息,得到输出层的情感分类结果;步骤4:对所提出的一种基于多领域统计特征和语音增强联合约束CNN‑DNN的噪声环境下语音情感识别方法进行性能评估。
📄 2022104941899
📂 G10L25_63
👤 南京邮电大学
📅 2022-05-07
本发明公开了一种基于跨模态特征融合的多任务加密网络流量分类方法,包括:获取待识别的原始流量;预处理原始流量,并获得其格式化样本;将格式化样本输入至训练完成后的基于特征融合技术的多模态多任务深度神经网络,得到对于每个任务对应的预测向量;取其中最大的值对应的分类作为加密流量在该任务上最终的分类标签。本发明能实现对流量特征的自动提取、融合,并根据融合后的结果做出多任务预测;具有通用性;实现包级别和流级别统计特征和有效载荷的融合;通过双路特征提取模块抽取每个数据包的有效载荷低阶的时序特征和全局统计特征,并用全局统计特征指导对有效载荷时序特征的进一步提取;改善了特征提取的效果,具有更好的分类效果。
📄 2021114313143
📂 G06K9_62
👤 南京邮电大学
📅 2021-11-29
本实用新型公开了一种具有语音和面部识别功能的智能门,包括门板,所述门板的内部设有空腔,所述空腔的中部焊接有控制器和蓄电池,所述门板的前端面中部焊接有人面识别器,所述人面识别器的两侧均焊接有限位条,所述人面识别器的前方设有保护盖,所述保护盖的顶端焊接有第一挡板,所述保护盖的两侧面均焊接有第一电动推杆,所述人面识别器的右侧焊接有支撑板,所述支撑板的顶面焊接有湿度传感器,所述支撑板的底面焊接有第二电动推杆,所述支撑板的下方两侧均焊接有第一固定销,两个所述第一固定销的下方焊接有语音识别器,本方案设计了一种具有语音和面部识别功能的智能门,对各种电器提供保护装置,保护电器不受到外部环境影响。
📄 2020219476970
📂 E06B7_28
👤 上海银昊金属装饰工程有限公司
📅 2020-09-09
本发明提供了图像加密技术领域的一种基于混沌映射和混沌S盒代换的图像加密方法,包括:步骤S10、获取彩色图像文件并进行哈希计算得到哈希值,基于哈希值计算系统参数;步骤S20、基于哈希值生成四维超混沌映射的四个初始值,进而得到四组混沌伪随机序列;步骤S30、基于混沌伪随机序列以及系统参数提取序列Wz,利用序列Wz以及使用AES算法的S盒生成混沌S盒;步骤S40、对彩色图像文件进行Arno l d置乱得到置乱图像,利用混沌S盒对置乱图像进行字节代换得到代换图像;步骤S50、利用混沌伪随机序列以及系统参数,对代换图像中RGB的三个分量进行图像扩散加密得到三个密文数据,基于各密文数据得到加密图像。本发明的优点在于:极大的提升了图像加密的安全性。
📄 2021103722565
📂 G06F21_60
👤 华侨大学
📅 2021-04-07
本发明涉及语音合成技术领域,具体公开了一种基于少量样本的说话人适应方法、语音翻译方法和系统,包括获取具有文本标注的语音数据,对语音数据进行预处理生成梅尔频谱;构建个性化语音合成模型,将梅尔频谱和文本输入个性化语音合成模型中获得预测梅尔频谱;基于梅尔频谱和预测梅尔频谱预训练个性化语音合成模型,并进行微调;获取目标说话人的语音和任意文本信息,对目标说话人的语音进行预处理以获得梅尔频谱;将梅尔频谱和任意文本信息输入训练好的个性化语音合成模型中,以获得预测梅尔频谱;基于预测梅尔频谱生成任意文本信息所对应的目标语音;该方法将语音中的内容特征和话人特征分离开,解决少量样本语音合成的说话人相似度低的问题。
📄 2023105803195
📂 G10L13_02
👤 澳克多普有限公司
📅 2023-05-23
已申报项目
本发明公开了一种基于变分自编码器的语音刺激连续统合成方法及装置,所述方法包括:从原始语音信号中提取关键声学线索;基于变分自编码器进行关键声学线索建模,并进行训练;利用训练好的关键声学线索模型合成语音连续统。所述装置包括:提取模块,用于从原始语音信号中提取关键声学线索;模型建立模块,用于基于变分自编码器进行关键声学线索建模,并进行训练;合成模块,用于利用训练好的关键声学线索模型合成语音连续统。本发明通过深度学习模型来合成感知实验中所需要的语音刺激连续统,能够解决现有技术中手动修改造成的信息损失和不自然的问题。
📄 2021108413924
📂 G10L13_02
👤 澳克多普有限公司
📅 2021-07-26
已申报项目
一种基于知识蒸馏的轻量化恶意加密流量检测方法,涉及网络安全态势感知技术领域,在第一阶段,利用了流量的原始特征信息进行快速过滤,减轻了后续深度学习模型的计算压力。随后,在第二阶段,我们进一步利用了流量的图像特征信息,并通过轻量级卷积神经网络(CNN)更全面地分析流的内容特征。两阶段方法大大提升了恶意加密流量的检测效率。其次,利用了知识蒸馏的训练策略,进一步提高系统对恶意加密流量的检测准确性。
📄 2024107962595
📂 H04L9_40
👤 山东省计算中心(国家超级计算济南中心); 齐鲁工业大学(山东省科学院)
📅 2024-06-20