本发明公开了一种面向医疗智能问答的文本语义匹配方法和装置,属于自然语言处理技术领域。本发明要解决的技术问题为如何捕获同一文本细粒度语义特征、文本间语义交互特征,以实现文本的语义匹配,采用的技术方案为:通过构建并训练嵌入层、语义编码层、多层次细粒度特征提取层、特征融合层和预测层组成文本语义匹配模型,提取文本字、词粒度特征,捕获同一文本细粒度语义特征、文本间语义交互特征,最终将多种相关特征合并,之后进行多种匹配操作,生成最终匹配特征向量并判定文本的相似度。该装置包括文本匹配知识库构建单元、训练数据集生成单元、文本匹配模型构建单元及文本语义匹配模型训练单元。
📄 2022109965048
📂 G06F16_332
👤 齐鲁工业大学
📅 2022-08-19
本申请所述方法针对表格问答系统中表格检索部分,提出了一种利用问句实现关联表格检索的方法与装置,该方法可以为问句匹配出最相关的表格。方法包括:根据问句和表格,分别计算问句中的词在表格中出现的频率,及表格中的词在问句中出现的频率;对问句和表格进行词嵌入向量表示;将问句与表格的词嵌入表示向量和计算频率进行融合,进而得到问句与表格的融合向量;最后融合向量将被用于计算问句与表格的相似性。
📄 2021115869861
📂 G06F16_3329
👤 浙江工业大学
📅 2021-12-23
基于用户行为的人工智能体设计的方法,包括:步骤S1,为指定人工智能体配置用户静态属性;S2,配置操作流程,模拟用户的正常行为;S3,在指定智能体运行过程中,保存智能体的行为数据;S4,收集平台的热点评论,根据指定参数,向指定平台发送评论内容;S5,根据记录数据,分析推荐算法对用户行为的影响。本发明还包括一种基于用户行为的人工智能体的系统,包括:属性配置模块,流程订制模块,数据保存模块,语料生成模块和行为分析模块。本发明可以模拟正常用户在各大社交平台的行为,并实现全自动化操作,通过实验数据,可以分析推荐算法对用户的影响,从而得到避免推荐算法对人的负面影响的途径。
📄 2022100635165
📂 G06F16_332
👤 浙江工业大学
📅 2022-01-20
一种基于部首特征和多层注意力机制的中文自动问答方法,包括以下步骤:步骤1、对数据集进行预处理;步骤2、得到词嵌入矩阵,通过随机初始化得到部首嵌入矩阵;步骤3、通过词嵌入和部首嵌入将词语分别转化为向量表示,在词语向量后追加语言学特征;步骤4、将文档向量序列问题向量序列分别输入至不同的双向RNN网络进行编码;步骤5、根据文档向量序列与问题向量,依次计算得到答案开始和结束边界的概率,生成目标概率分布,步骤6、使用数据集对模型训练N轮,通过计算损失并对参数进行更新,使用mini‑batch策略对模型进行训练,使用模型对给定的一个文档和与之相关的问题进行处理,预测得到答案。本发明提高了自动问答的准确率。
📄 2021113251582
📂 G06F16_3329
👤 浙江工业大学
📅 2021-11-10
一种基于知识图谱的中文医药问答系统,包括知识图谱构建模块、问题分类模块、数据库查询模块、答案整合模块和结果展示模块。一种基于知识图谱的中文医药问答方法,包括以下步骤:S1.获取用户的查询文本;S2.对用户的问句进行解析,获取主语实体、问题类别和问题类型;S3.根据解析结果以及预先构建的中文医药知识图谱进行相关查询,获取查询结果;S4.对医药查询结果进行整理,形成符合自然语言的对话答案以及可视化数据;S5.对文本答案以及可视化数据进行展示。本发明提高了问题类型划分的准确率以及答案精度,满足了用户医药咨询、食品指南、疾病辅助诊疗的需求,为用户提供了更加便捷高效的服务。
📄 2021107637044
📂 G06F16_332
👤 浙江工业大学
📅 2021-07-06
本发明公开一种基于大数据预测核心微生物组的方法,该方法基于公共数据库中可获取的16S rRNA基因高通量测序数据,通过对所有独立实验的测序数据的质控、过滤、合并和注释,得到归一化的微生物数据表格,从中获取每个物种基于独立实验数和样本数的检出频率以及每个微生物物种的相对丰度。通过整合和量化这几个因子构建物种的核心指数计算公式,从而确定某一类微生物群落的核心微生物组。本发明方法基于公开的16S rRNA基因测序数据库,能够便捷预测环境中相似类型环境介质和亲缘宿主相关的核心微生物组,且呈现较高可信度,可广泛应用于微生物研究体系的预测,增加研究的普适性。
📄 2021109016005
📂 G06F16_332
👤 浙江工业大学
📅 2021-08-06
一种基于专业词汇挖掘的专业领域FAQ智能问答方法,包括以下步骤:(1)频繁词挖掘与归并:基于子串挖掘算法从专业领域文档集中挖掘出候选频繁词,并对同频候选频繁词进行归并,最终得到频繁词集;(2)频繁词过滤与验证:采用词法规则对频繁词进行过滤,采用互联网知识对频繁词进行验证,最终得到专业词汇集;(3)问题检索与答案返回:借助专业词汇集抽取实时问题关键词,在此基础上对历史问题进行全文检索和匹配度计算,最终返回匹配度最高的历史问题对应的答案。本发明提供了一种提高专业领域FAQ智能问答系统的服务质量的基于专业词汇挖掘的专业领域FAQ智能问答方法。
📄 2019103169086
📂 G06F16_332
👤 浙江工业大学
📅 2019-04-19
基于电商知识图谱的商品信息自动问答方法,用于电商领域的知识图谱问答任务,包括:首先统计电商知识图谱中的实体与关系种数并分别赋予初始分数,其次将用户提出的自然语言问题分词后提取主题实体,从电商知识图谱中对应的实体节点出发,利用三元组的头实体分数与关系分数计算尾实体的分数并更新实体分数集合,得到一种可解释的知识图谱问答核心路径推理模型。本发明通过提取自然语言问题特征向量来在电商知识图谱中计算推理路径,从而提高商品信息自动问答的准确性和可解释性。
📄 2023105710769
📂 G06F16_332
👤 浙江工业大学
📅 2023-05-17
基于拼音嵌入增强和多层信息融合的中文机器阅读理解方法和装置,其方法包括:S1:对数据集预处理;S2:中文分词操作,获得拼音嵌入向量PE;S3:将段落和问题拼接,输入到BERT,得到词嵌入向量Etoken;S4:基于拼音嵌入PE和词嵌入Etoken,通过全连接层,再与段嵌入Eseg和位置嵌入Epos相加,得到嵌入向量w;S5:进行BERT编码,得到编码向量表示;S6:将编码向量表示与词嵌入表示进行多层注意力融合,得到融合低层级问题语义信息的上下文表示向量;S7:进行多层注意力融合计算,得到融合高层级问题语义信息的上下文表示向量;S8:利用编码器的自注意力,得到融合多层信息的上下文语义向量;S9:预测答案起始点和结束点的概率分布,选择概率最大的组合确定答案跨度。
📄 2024105675609
📂 G06F16_3329
👤 浙江工业大学
📅 2024-05-09
本发明提出一种选择题选项生成方法,包括:获取目标对象的做题记录,并从所述做题记录中获取知识集合;根据所述知识集合从题库中获取所述目标对象的待做题目;根据所述待做题目包含的知识点,从所述题库中获取候选选项,并根据所述候选选项生成所述待做题目的备选项;本发明通过学情分析与选项生成相结合,可用于强化对于薄弱知识点的掌握情况,提高学习效率。
📄 2020102906656
📂 G06F16_332
👤 西南大学
📅 2020-04-14
本公开的实施例公开了建筑知识问答系统和建筑知识答复信息生成方法。该系统的一具体实施方式包括:客户端、服务器、数据库服务器,其中:数据库服务器被配置成创建建筑知识库与建筑知识图谱;客户端被配置成将建筑知识需求信息发送至服务器;服务器被配置成执行:提取建筑知识需求信息对应的深度语义信息;数据库服务器进一步被配置成检索所创建的建筑知识库与建筑知识图谱;服务器进一步被配置成执行以下步骤:将建筑知识需求信息、意图识别信息与建筑知识库查询信息输入至建筑知识问答模型;将实体概念信息集与初始建筑知识答复信息确定为建筑知识答复信息;将建筑知识答复信息发送至客户端。该实施方式提高了建筑知识答复信息的准确性。
📄 202410876685X
📂 G06F16_3329
👤 铯镨科技有限公司
📅 2024-07-02
本发明涉及一种基于堆叠Bi‑LSTM网络和协同注意力的虚拟学习环境智能问答方法,属于自然语言处理和虚拟现实技术领域。该方法包括:S1:构建知识库及数据预处理;S2:特征提取及向量表示:在构建堆叠Bi‑LSTM网络的模型中配置co‑attention机制与attention机制;S3:同时考虑问答对空间向量的位置与方向,调和余弦相似度与欧几里德距离来计算问答对向量间的匹配度;S4:基于Unity3D平台搭建虚拟学习环境并引入网络模型,实现特定域虚拟课堂的智能问答。本发明将深度网络模型与多类注意力机制结合,实现了问答对更深层次的交互理解与表示,同时特定域虚拟课堂的引入拓宽了智能问答的应用范围。
📄 2019100369273
📂 G06F16_332
👤 滁州明晟智能科技有限公司
📅 2019-01-15