发明专利 已授权

基于多模态融合模型的提高视频问答精度方法及系统

📄 申请号:CN202011205724.1 📄 发布日:2026/07/23

著录项目信息

申请日
2020-11-02
公开号
CN112559698B
公开日
2022-12-09
申请人
山东师范大学
法律状态
已下证
专利类型
发明
主分类号

技术画像

应用场景

视频问答, 智能视频分析, 人机交互, 智慧教育, 视频检索

摘要

本公开提供了一种基于多模态融合模型的提高视频问答精度方法及系统,包括:采集视频数据和问题特征,获取视频问答的问题;从视频数据中提取视觉特征和字幕特征;将视觉特征和字幕特征进行融合处理,获得融合视觉特征和融合字幕特征;将融合视觉特征、融合字幕特征和问题特征输入多模态融合模型中进行训练,获得训练好的多模态融合模型;将视频问答的问题输入训练好的多模态融合模型,获得问题答案;根据问题的特点针对不同的问题聚焦不同的目标实体实例,提高了模型选择答案的准确性。
权利要求书 (12项) 说明书 附图

……

……

图1
图2
图3

法律状态时间线

相似专利推荐 AI 驱动 · 同领域

暂无同领域相似专利推荐
议价
不含过户费

📋 交易方式: 委托待转让 📌 交易状态: 在售 👁️ 浏览次数:37 ❤️ 收藏人数:93 📋 项目申报: 未申报

资金托管 权属尽调 包过户
🏢 淄博智来知识产权服务有限公司
✓ 企业认证✓ 手机绑定历史成交 0件好评率 98.5%

📊 出价记录 (3条)
王**¥-10万
李** 企业¥-8万
陈**¥-3万
查看全部出价