发明专利 已授权

医学短文本数据负样例采样方法及医学诊断标准术语映射模型训练方法

📄 申请号:CN202010159004.X 📄 发布日:2026/04/29

著录项目信息

申请日
2020-03-09
公开号
CN111460091B
公开日
2023-10-27
申请人
上海科培企业管理咨询有限公司
法律状态
已下证
专利类型
发明
主分类号

技术画像

应用场景

电子病历分析, 临床辅助诊断, 医学文本标准化, 医疗数据挖掘, 智能问诊

摘要

本发明涉及医学短文本数据负样例采样方法及医学诊断标准术语映射模型训练方法,包括:基于原始医学诊断数据得到待映射文本,进而生成训练集,验证集,测试集、基于标准术语集和待映射文本集合生成正样例集合、对于正样例集合中的任意正样例,基于相似度计算函数生成候选负样例集合、获取正样例集合的一个子集,对于其中的每个正样例,从候选负样例集合中抽取部分或全部负样例生成训练集,将正样例集合的子集与训练集合并后形成一个训练批次、将训练批次带入神经网络模型中进行训练。本发明提取负样例更具代表性,分别提起正负样例对修改的模型进行模拟训练,实现对模型进行泛化改进,模型的性能得到提升,提升了对未知细粒度术语的识别泛化性。
权利要求书 (12项) 说明书 附图

……

……

图1
图2
图3

法律状态时间线

相似专利推荐 AI 驱动 · 同领域

暂无同领域相似专利推荐
议价
不含过户费

📋 交易方式: 委托待转让 📌 交易状态: 在售 👁️ 浏览次数:67 ❤️ 收藏人数:93 📋 项目申报: 已报项目

资金托管 权属尽调 包过户
🏢 淄博智来知识产权服务有限公司
✓ 企业认证✓ 手机绑定历史成交 0件好评率 98.5%

📊 出价记录 (3条)
王**¥-10万
李** 企业¥-8万
陈**¥-3万
查看全部出价