摘要
本发明公开了一种多尺度特征融合和边界信息注意的视频显著目标检测方法。所述方法包括如下步骤:获取视频显著目标检测数据集及对应光流图,输入到训练好的视频显著目标检测网络中;采用双流主干特征编码器,获取多层级特征;利用全局引导多尺度融合模块,以获取多尺度时空特征;通过跨模态边界注意模块,改善多尺度时空特征的边界检测效果;采用场景感知融合模块,以促进时空特征融合;将融合后的特征不断解码,恢复至原始视频帧尺寸,以获取最终的显著性图。所述方法探索多尺度时空特征融合和边界注意方法,提高了视频显著目标检测的精度,改善了边界检测效果。