发明专利 已授权

基于目标空间语义对齐的视频描述方法

📄 申请号:CN202111404350.0 📄 发布日:2026/05/14

著录项目信息

申请日
2021-11-24
公开号
CN114154016A
公开日
2022-03-08
申请人
杭州电子科技大学
法律状态
已下证
专利类型
发明
主分类号
IPC 分类号

技术画像

应用场景

视频自动描述, 视频检索与索引, 多模态内容理解, 智能视频监控, 无障碍辅助

摘要

本发明公开了基于目标空间语义对齐的视频描述方法。本发明方法首先对含文本描述的采样视频帧提取外观特征和动作特征,将其拼接后输入到时序高斯混合空洞卷积编码器获得时序高斯特征;然后利用两层长短时记忆神经网络构建解码器,得到生成语句概率分布和隐藏向量;再建立语义重构网络并计算语义重构损失;利用随机梯度下降算法优化模型,对新视频依次通过上述步骤获得生成语句概率分布,用贪心搜索算法获得视频描述语句。本发明方法利用时序高斯混合空洞卷积对视频长期时序关系进行建模,并通过语义重构网络获得语句级的概率分布差异,能够缩小生成语句和视频内容的语义鸿沟,从而生成更准确描述视频内容的自然语句。
权利要求书 (12项) 说明书 附图

……

……

图1
图2
图3

法律状态时间线

相似专利推荐 AI 驱动 · 同领域

暂无同领域相似专利推荐
议价
不含过户费

📋 交易方式: 委托待转让 📌 交易状态: 在售 👁️ 浏览次数:83 ❤️ 收藏人数:93 📋 项目申报: 未申报

资金托管 权属尽调 包过户
🏢 淄博智来知识产权服务有限公司
✓ 企业认证✓ 手机绑定历史成交 0件好评率 98.5%

📊 出价记录 (3条)
王**¥-10万
李** 企业¥-8万
陈**¥-3万
查看全部出价