本发明公开了基于时空传播层次编解码器的视频预测方法。本发明方法首先对给定的原始视频进行采样获得帧序列并输入至低层视觉记忆编码器,得到低层视觉编码特征和低层记忆状态特征;然后分别利用时空传播模块从低层视觉编码表示中提取时空编码特征,以及通过高层语义编码器提取高层语义特征;再将得到的低层视觉编码特征、低层记忆状态特征和高层语义编码特征通过层次特征解码器进行信息融合,输出预测视频帧。本发明方法不仅能够将低层视觉记忆特征和高层语义特征相融合,并通过时空传播模块使得低层视觉信息沿时序方向传播,还能利用视频首帧的先验知识一定程度上解决视频帧模糊问题,从整体上提高预测视频帧的清晰度和视觉质量。
📄 2021105340565
📂 H04N19_107
👤 杭州电子科技大学
📅 2021-05-17