基于随机锚点对选择的局部模型加权融合Top‑N电影推荐方法,利用电影文本数据通过LDA主题模型和GBDT梯度提升决策树得到用户和电影在语义层次的特征向量,然后基于该特征向量分别计算用户和电影的高斯核相似度,接着在原始数据集中随机选择多个<用户,电影>锚点对,并结合用户和电影的高斯核相似度为每个锚点对重新构造局部训练矩阵,再利用SLIM稀疏线性模型作为基本推荐模型为每个局部训练矩阵训练得到对应的局部推荐模型,最后通过局部推荐模型之间的加权融合生成最终的融合推荐模型。该推荐方法在数据稀疏的场景下也保持了模型的稳定性,能有效解决传统单一推荐模型在数据稀疏场景的极易发生过拟合的问题。
📄 2018104716409
📂 G06F16_783
👤 浙江工业大学
📅 2018-05-17
一种基于自注意力的融合三元组信息的短序列扩充电影推荐方法,包括以下步骤:1)原始数据处理:处理用户观看电影的历史数据,并根据预先设定好的电影关系为每部电影制作知识图谱;2)根据时间戳为每个用户制作观看的历史电影序列,使用单向Transformer模型反向训练模型,得到反向的预训练模型,使用反向的预训练模型生成扩充的增强数据;3)将扩充后的数据送入预训练模型进行正向模型的微调,得到正向的预训练模型;4)使用正向微调后的模型预测用户下一部即将观看的电影。本发明对短序列进行扩充,增强了数据,解决部分冷启动问题,对电影的推荐提供有力的帮助。
📄 2022105884075
📂 G06F16_783
👤 浙江工业大学
📅 2022-05-26
一种基于文本动态生成教学视频的编辑方法,主要步骤包括:获取用户输入的文字、对文字进行NLP处理、检索教学视频、将元视频数据转换为音视频、进行元视频数据相似度特征计算、用户选择音视频素材、合成虚拟人教学示例。本发明可以根据文字动态生成教学视频,自动创造虚拟示范,以降低视频制作的技术门槛,减少视频制作的时间与人力开销;并且能快速找到适合的示范素材,提高示例检索的效率,提升教学用户的教学体验。
📄 2023103806413
📂 G06F16_783
👤 淮阴工学院
📅 2023-04-11
本发明一种基于语义信息引导的视频内容描述方法。本发明包括如下步骤:步骤(1)对视频格式进行预处理;步骤(2)建立用于引导的语义信息;步骤(3)计算语义特征向量[Ai,XMS(i)]的权重步骤(4)对语义特征向量[Ai,XMS(i)]进行解码;步骤(5)对视频描述模型进行测试。本发明通过利用faster‑rcnn模型,能快速检测每帧图像上的关键语义信息,并加入到原有用CNN提取的特征中,使得每个时间节点输入LSTM网络的特征向量具有语义信息,从而在解码过程中,既保证视频内容时空关联性,又提高了语言描述的准确率。
📄 2017101748831
📂 G06F16_783
👤 杭州电子科技大学
📅 2017-03-22
本公开公开了基于多尺度图的视频突发事件监测方法及系统,对初步采样的视频数据进行关键帧提取,形成视频摘要序列;对视频摘要序列进行视频序列周期估计,从而估算视频监测内容的运行周期;对视频摘要序列以周期为单位进行多尺度图模型建模并不断更新模型参数;将一组多尺度图中与其他多尺度图距离度量和最小的图定义为中值图并不断更新中值图,从而将视频突发事件监测问题转换为与中值图的距离度量问题;在每个监测周期,将多尺度图模型与中值图进行差异度计算;在视频突发事件检测系统运行过程中,利用长度固定的滑动窗口对视频摘要序列进行突发事件监测。
📄 2019109931726
📂 G06F16_78
👤 山东师范大学
📅 2019-10-18
本发明实施例提供了一种人员关系确定方法、装置、电子设备及存储介质,方案如下:获取包含目标人员的监控视频,获取该监控视频中的视频结构化数据,根据视频结构化数据中包含的人员身份数据和人员互动数据,确定目标人员和其他人员之间的关系指数。通过本发明实施例提供的方案,可以对监控视频中的视频结构化数据,快速高效的对监控视频中出现人员之间的人员关系进行分析,降低人工主观因素导致的误判概率。
📄 2019106702693
📂 G06F16_783
👤 杭州海康威视系统技术有限公司
📅 2019-07-24
本发明公开了基于目标空间语义对齐的视频描述方法。本发明方法首先对含文本描述的采样视频帧提取外观特征和动作特征,将其拼接后输入到时序高斯混合空洞卷积编码器获得时序高斯特征;然后利用两层长短时记忆神经网络构建解码器,得到生成语句概率分布和隐藏向量;再建立语义重构网络并计算语义重构损失;利用随机梯度下降算法优化模型,对新视频依次通过上述步骤获得生成语句概率分布,用贪心搜索算法获得视频描述语句。本发明方法利用时序高斯混合空洞卷积对视频长期时序关系进行建模,并通过语义重构网络获得语句级的概率分布差异,能够缩小生成语句和视频内容的语义鸿沟,从而生成更准确描述视频内容的自然语句。
📄 2021114043500
📂 G06F16_78
👤 杭州电子科技大学
📅 2021-11-24
本发明涉及数字通信技术领域,公开一种基于电子地图的视频检索方法及系统,以提高游客获取资源的便捷性、特色景观的曝光率及游客对景区的整体满意度。包括:提取景区内各特色景观的数字特征并封装为对应的数字模型,将电子地图、LBS定位与图像检索相结合,游客可以在景区内通过即兴拍照便捷地获取特色景观全景视频解说内容。且在检索过程中,先筛选出与检索请求LBS位置之间的距离在设定阈值内的数字模型,相比对景区内所有数字模型进行近似度比对而言,节约了云端服务器的资源并提高了数据处理的实时性。进一步地,通过仅对景区内真实游客开启调用移动终端的相机进行即兴拍照检索的权限,有效节约了网络带宽并缓解了云端服务器的负荷压力。
📄 2021107888381
📂 G06F16_787
👤 湖南中惠旅智能科技有限责任公司
📅 2021-07-13
本申请公开了一种检索方法及装置、存储介质,其中,所述的方法包括:确定文本和至少一个视频之间的第一相似度,所述文本用于表征检索条件;确定所述文本的第一人物互动图和所述至少一个视频的第二人物互动图;确定所述第一人物互动图和所述第二人物互动图之间的第二相似度;根据所述第一相似度和所述第二相似度,从所述至少一个视频中确定出与所述检索条件相匹配的视频。
📄 2019109348925
📂 G06F16_783
👤 北京市商汤科技开发有限公司
📅 2019-09-29
本发明公开了一种基于人脑情景记忆通路启发的文本视频检索方法,方法包括利用内容编码组件对目标文本数据或目标视频数据进行内容表征提取获得多尺度目标表征;利用情境编码组件对目标文本数据或目标视频数据进行情境表征提取获得目标令牌;将多尺度目标表征和目标令牌输入至双曲图神经网络获得目标场景表征;将目标场景表征作为目标索引;计算待检索文本或视频的表征与目标索引的相似度,根据相似度对待检索文本或视频进行筛选获得目标检索结果;本发明通过多粒度信息融合全面捕捉的多层次语义特征,通过双曲图卷积操作融合多模态、多粒度的高阶信息,能够更好地捕捉文本和视频之间的复杂关系,显著提升了文本视频检索的精度与效率。
📄 2025104163576
📂 G06F16_783
👤 南京信息工程大学
📅 2025-04-03
本发明提供的一种基于大数据处理的文件命名方法和系统,本发明涉及文件命名技术领域,该方法包括获取多个待命名视频文件;基于文件分析模型对所述多个待命名视频文件进行处理确定每一个待命名视频文件的代表帧;基于所述每一个待命名视频文件的代表帧使用卷积神经网络模型确定每一个待命名视频文件的多个备选命名、不同代表帧之间的内容相似度;基于所述每一个待命名视频文件的多个备选命名、不同代表帧之间的内容相似度确定每一个待命名视频文件的文件目标命名;基于所述每一个待命名视频文件的文件目标命名对每一个视频文件进行命名,该方法能够准确的对一次性接收到的大量的视频文件进行命名。
📄 2025102624239
📂 G06F16_783
👤 临沧润逦领科技有限公司
📅 2025-03-06
本发明实施例提供了一种目标对象检索方法及装置,所述方法包括:获取包含目标对象的比对图片,在监控图像中检索与所述比对图片的相似度大于预定阈值的第一图像,并获取各第一图像对应的位置信息和时间信息;获取已知位置信息和时间信息对;对位置信息和时间信息与所述已知位置信息和时间信息对不匹配的第一图像进行过滤,得到过滤后的第二图像。本发明实施例中,能够通过已知目标对象出现的位置信息和时间信息对,对检索得到的结果进行过滤,从而可以提高目标对象检索结果的准确性。
📄 2016107341665
📂 G06F16_78
👤 广州高航技术转移有限公司
📅 2016-08-26