一种语音大数据识别系统,包括基于语音识别AI技术的智能门锁本体;还具有第一触发电路、第二触发电路和复位电路;第一触发电路、第二触发电路和复位电路安装在门锁本体内;并和智能门锁本体内蓄电池正、语音识别模块继电器电源输出端电性连接。本发明应用中,当使用者第一次发声,语音识别模块识别正确后会控制第一触发电路得电,当使用者第二次发声,语音识别模块识别正确后会控制第二触发电路得电,进而智能门锁本体的电磁锁芯打开。本发明只有在一定时间内,当输入的声纹信息被语音识别模块两次以上判断准确后,控制电路才会控制门锁的电磁锁芯打开,防止了语音识别模块只识别比对一次声纹信息就打开门锁,无法达到好的安全效果弊端。
📄 2020109010911
📂 G07C9_00
👤 哈尔滨必备科技有限公司
📅 2020-08-31
本实用新型属于门禁语音信息处理装置领域,具体公开了一种智能语音信息处理模块,包括语音信息处理装置以及门体;语音信息处理装置安装在门体上,语音信息处理装置包括壳体,壳体的内部安装有语音信息处理本体,壳体的一端卡接有防尘罩;语音信息处理装置朝向门体的一侧固定连接有固定块,固定块朝向门体的一侧设有第一插槽;门体上设有用于固定块嵌入的凹槽,门体上于语音信息处理装置的上下侧对称安装有固定机构,固定机构包括连接板,连接板朝向语音信息处理装置的一侧固接有伸缩杆,伸缩杆远离连接板的一端固接固定板,伸缩杆的外部套设有锁紧弹簧;本实用新型中语音信息处理装置的安装与拆卸简单,方便对语音信息处理本体维修、更换。
📄 2020200970263
📂 F16M13_02
👤 安徽中科徽美信息科技有限公司
📅 2020-01-16
已申报项目
本发明公开了一种信息化合成语音的识别方法,涉及智能语音技术领域,用于解决信息化合成语音识别判定的精准性较的问题,具体步骤包括:采集样本语音并进行预处理,获取处理语音;通过语音内容分析模型对处理语音进行音频特征提取,并对处理语音进行文本转化,生成处理语音文本;对处理语音文本进行文本内容特征的提取,并公式化分析生成兴奋系数;设置兴奋系数比对阈值,将兴奋系数比对阈值与兴奋系数进行比对处理,生成情绪标识;对音频特征进行分析,生成音文差异值,对音文差异值进行阈值比对,进而生成音文符合程度标识;将情绪标识和音文符合程度标识进行整合处理,生成识别目标,并对对应样本语音进行标记。
📄 2023108358023
📂 G10L13_08
👤 中国信息通信研究院
📅 2023-07-07
本发明公开了一种基于语音理解的短视频自动生成字幕的方法及系统,用于自然语言处理领域,该方法包括以下步骤:收集短视频的语音数据样本和文本数据;构建语音识别模型,同时依据文本数据构建语言理解模型;通过改进Bagging算法构建端到端语音理解模型;结合阈值法和视频信息的端点检测算法,提取出音频数据;将提取的音频数据输入端到端语音理解模型,生成对应的文本语义信息;将文本语义信息与视频时序信息相结合,自动渲染生成字幕;提供交互接口,对语音识别的错误结果进行校正。本发明共享语义表示,两任务互促进,语音编码器提取的语义特征可同时服务于语音识别和语言理解任务,两任务在统一模型中进行联合优化。
📄 2023112546805
📂 G10L15_18
👤 北京华星酷娱文化传媒有限公司
📅 2023-09-27
本发明公开了一种基于残差门控循环单元的语音识别方法,在现有的门控循环单元的基础上,结合残差连接以及非饱和激活函数来改进候选隐状态公式,使门控循环网络在不增加参数量的情况下能够不发生网络退化的进行更深层的训练。最后,通过多组对比实验,证明本发明的算法结构的有效性。
📄 2019101980584
📂 G10L15_02
👤 三峡大学
📅 2019-03-15
本申请公开了语音识别控制方法、装置、电子设备和可读存储介质,涉及人工智能和语音识别领域。具体实现方案为:在第一工作状态下,探测具有设定控制意图的目标操作;其中,第一工作状态下,根据唤醒词采集音频片段,以进行语音识别;若探测到目标操作,执行目标操作对应的控制指令,并将第一工作状态切换为第二工作状态;在第二工作状态下,连续采集音频得到音频流,以进行语音识别。该方案中,用户只需触发具有设定控制意图的目标操作,即可实现与电子设备进行连续交互,而无需连续输入唤醒词,可以简化用户操作,改善用户的使用体验。
📄 2019108882313
📂 G10L15_22
👤 百度在线网络技术(北京)有限公司, 上海小度技术有限公司
📅 2019-09-19
本申请公开了语音控制方法、装置、电子设备和可读存储介质,涉及语音识别领域。具体实现方案为:根据展示页面可响应的语音指令,确定第一引导词,获取展示页面所属前台程序可响应的语音指令,根据前台程序可响应的语音指令,以及根据后台程序可响应的语音指令,确定第二引导词,在目标工作状态下,提示第一引导词和第二引导词;其中,目标工作状态,用于连续采集音频得到音频流,并获取音频流语音识别得到的信息流,以根据信息流进行语音控制。由此,通过在目标状态下提示第一引导词和第二引导词,用户根据第一引导词和第二引导词与电子设备进行语音交互时,无需重复输入唤醒词,可以简化用户操作,改善用户的使用体验。
📄 2019109338158
📂 G10L15_22
👤 百度在线网络技术(北京)有限公司, 上海小度技术有限公司
📅 2019-09-29
本发明提出了一种基于多领域统计特征和改进CNN的含噪语音情感识别方法,属于语音识别领域,包括以下步骤:步骤1:首先对语料库中的纯净语音进行加噪处理,其次提取语音信号的相关多领域特征,采用统计函数对已提取的特征进行筛选,降低特征冗余度,得到冗余度低、情感区分度高的多领域统计特征;步骤2:搭建基于语音增强联合约束CNN‑DNN的框架;步骤3:将多领域统计特征作为系统模型的输入,提取与情感分类标签高度相关且对噪声具有鲁棒性的信息,得到输出层的情感分类结果;步骤4:对所提出的一种基于多领域统计特征和语音增强联合约束CNN‑DNN的噪声环境下语音情感识别方法进行性能评估。
📄 2022104941899
📂 G10L25_63
👤 南京邮电大学
📅 2022-05-07
本申请实施例涉及教育技术领域,公开一种听写检测方法及电子设备、计算机可读存储介质。该方法包括:对纸张某一面上的内容进行拍摄,获得初始图像;检测初始图像中是否存在无效内容;若存在,在初始图像中为无效内容添加预设的无效标记,以生成目标图像;检测目标图像中的内容,并根据无效标记从检测到的目标图像的内容中排除无效内容,以获得听写内容;根据报读内容对该听写内容进行批改,以获得听写结果。实施本申请实施例,能够提升听写检测的准确性。
📄 2019106866640
📂 G06K9_20
👤 广东小天才科技有限公司
📅 2019-07-29
一种听写内容辨别方法及电子设备,该方法包括:对纸张某一面上的文本内容进行拍摄,获得拍摄图片;对拍摄图片进行图片增强处理,获得增强图片;将增强图片中的该文本内容包括的每一内容单元的笔迹深度与预先收集到的手写笔迹深度进行对比;若对比出该内容单元的笔迹深度小于预先收集到的手写笔迹深度并且该内容单元的笔迹深度与预先收集到的手写笔迹深度的差值不在指定范围内,将该内容单元作为待过滤内容;从该文本内容中过滤掉所有的待过滤内容,并将该文本内容过滤掉所有的待过滤内容之后的剩余内容作为所述某一面上的听写内容。实施本发明实施例,能够提升辨别听写内容的准确性。
📄 2019106225105
📂 G09B5_06
👤 广东小天才科技有限公司
📅 2019-07-11
本发明公开了一种基于语音分析与合成驱动的Java代码生成方法,涉及语音识别领域,方法包括:通过语音采集与预处理模块将用户的自然语言Java指令转换为预处理后的数字语音流;特征提取模块从中抽取声学特征向量;语音识别模块解码生成文本命令;文本命令与预定义的语法模式匹配后生成结构化的命令实例并转化为抽象语法树片段;通过路径计算策略插入到抽象语法树中;代码生成模块将语法树转为Java源代码并进行错误检测;若无错误则输出Java代码;若有错误则输出错误信息;最终结果通过语音合成模块转换为自然语音流反馈给用户。本发明通过语音识别与代码自动生成技术,实现自然语言到Java代码的转换,减少手动编码量,提升了编码效率并减轻程序员负担。
📄 2025106905852
📂 G06F8_33
👤 龙岩学院
📅 2025-05-27
本发明涉及一种声控开关开启系统,包括:可延伸吸头,由两长杆构成,两个长杆都安装上时,为长吸头模式,只安装一个长杆时,为短吸头模式;吸头驱动设备,与所述可延伸吸头连接,用于控制所述可延伸吸头与吸尘器的机壳的相对角度;半透明集尘箱,用于保存由所述可延伸吸头吸过来的灰尘;声控开关,用于根据用户发出的声音信号控制吸尘器的运行模式,还用于在接收到第一识别信号时,进入休眠状态,以及在接收到第二识别信号时,进入工作状态;人员检测设备,用于在从多个内容丰富区域中识别到人员外形时,发出第二识别信号,否则,发出第一识别信号。通过本发明,避免出现吸尘器声控开关无效运行的情况。
📄 2018113929885
📂 A47L9_00
👤 江苏九川科技有限公司
📅 2018-11-21