发明专利 已授权

一种基于CNN和拼音特征的中文短文本相似度计算方法

📄 申请号:CN202211166508.X 📄 发布日:2026/08/04

著录项目信息

申请日
2022-09-23
公开号
CN115525735B
公开日
2025-12-19
申请人
浙江工业大学
法律状态
已下证
专利类型
发明
主分类号

技术画像

应用场景

智能问答, 信息检索, 文本去重, 语义匹配, 智能客服

摘要

本发明涉及一种基于CNN和拼音特征的中文短文本相似度计算方法,包括:生成两个中文短文本的句子列表,然后生成句粒度拼音嵌入矩阵和句粒度词嵌入矩阵,将相同字的向量拼接并融合;计算两个文本中两个字的注意力分数,生成两个文本间每个字的注意力矩阵,将注意力矩阵与权重矩阵相乘,生成高粒度的句子特征映射;计算单个字的注意力权重并进行平均池化,生成两个中文短文本的句向量;将句向量输入逻辑回归层,计算得到两个中文短文本的相似度。本发明的方法将汉字的拼音信息结合到词分析中来学习更准确的表征,从而用于在中文短文本相似度匹配任务中综合考虑文字的读音,结合读音所表征的语义更精确判断相似度。
权利要求书 (12项) 说明书 附图

……

……

图1
图2
图3

法律状态时间线

议价
不含过户费

📋 交易方式: 委托待转让 📌 交易状态: 在售 👁️ 浏览次数:20 ❤️ 收藏人数:93 📋 项目申报: 未申报

资金托管 权属尽调 包过户
🏢 淄博智来知识产权服务有限公司
✓ 企业认证✓ 手机绑定历史成交 0件好评率 98.5%

📊 出价记录 (3条)
王**¥-10万
李** 企业¥-8万
陈**¥-3万
查看全部出价