本发明属于计算机视觉的领域,公开了一种基于文本条件扩散模型的语义图像编辑方法,该方法首先利用不同文本在文本条件扩散模型下对同一初始图像加噪会产生不同的噪声估计,通过差异计算得出遮罩,用去噪扩散隐式模型DDIM编码函数对输入图像进行加噪,通过将遮罩外的像素值替换为初始图像DDIM加噪得到图像像素值来指导扩散模型,然后解码自然地映射回原始像素。该方法通过U‑net预训练模型只进行一次噪声预测即提高遮罩的生成速度,根据噪声预测差值生成遮罩对图像进行局部编辑,降低在不需要编辑的区域中修改输入的风险,提高合成图像的质量。
📄 2024100246429
📂 G06T11_60
👤 南京邮电大学
📅 2024-01-08
一种基于改进的卷积神经网络实现图像编辑传播的方法,首先引入组合卷积来代替传统的卷积,通过这个结构可以提取更加合理的图像特征,并且减少模型的参数量和卷积的操作数。同时引入对错分的背景类进行加权的有偏损失函数,以防止背景类被误着色而造成颜色溢出。该方法包括以下步骤:通过交互的方式对一幅待处理的图像加以笔触;根据笔触从图像中提取训练集和测试集;利用改进的卷积神经网络进行模型训练;利用训练得到的模型进行测试,最终实现图像上色。
📄 2017114286120
📂 G06T11_80
👤 浙江工业大学
📅 2017-12-26
本发明属于图像处理技术领域,具体涉及一种基于特征定位融合的文本编辑图像系统及方法,该系统的生成器包括多个深度注意力编辑块、特征定位模块和卷积层,各深度注意力编辑块逐个串联;除第一个深度注意力编辑块外的其他深度注意力编辑块,每个深度注意力编辑块的输入为前一个深度注意力编辑块输出的图像特征、由文本编码器编码的文本特征和由特征定位模块输出的图像定位特征,最后一个深度注意力编辑块输出的图像特征进入卷积层,卷积层将图像特征转换为生成图像。本发明能够准确地定位和识别图像中的不同部分,并将它们与文本描述进行匹配,提高图像编辑的准确性。
📄 2024106892133
📂 G06T11_60
👤 江西农业大学
📅 2024-05-30
本发明公开了一种视频窗口组件半透明显示方法,该方法包括:获取视频窗口组件的尺寸,以及终端设备的屏幕分辨率;根据所述视频窗口组件的尺寸以及所述屏幕分辨率将原始背景图像编辑为DIV图层;将所述DIV图层导入到canvas元素,然后进行半透明显示设置;将半透明设置后的canvas元素填充到所述视频窗口组件。本发明还提供一种视频窗口组件半透明显示装置、服务器及计算机可读存储介质。本发明提供的视频窗口组件半透明显示方法、装置、计算机设备及计算机可读存储介质能够实现基于视频网页页面自身元素的视频窗口组件半透明化,从而不需要额外加载ActiveX控件,而且适应性更强,应用效果更好。
📄 2019100268450
📂 H04N21_431
👤 平安科技(深圳)有限公司
📅 2019-01-11
本发明提供一种铁路货运列车图像异常区域编辑方法及系统,涉及图像处理技术领域,该方法包括:获取铁路货运列车的车厢的原始图像,以及异常区域的编辑指令;将编辑指令和原始图像输入大语言模型进行解析,将编辑指令逐步分解为子任务链;对编辑指令提取目标语义信息,再对原始图像提取图像特征,进行目标区域定位,生成空间掩码;将目标语义信息和图像特征融合,得到语义控制向量,根据语义控制向量和空间掩码以及图像特征,进行图像编辑,得到初始编辑图像;对原始图像与初始编辑图像进行匹配融合,得到异常区域编辑图像,本发明能够解决现有技术中传统的人工监控铁路货运安全,具有严重的滞后性和需花费高昂的成本的技术问题。
📄 2025109694707
📂 G06T11_60
👤 华东交通大学
📅 2025-07-15
本发明公开了一种基于梯度结构相似性的无鬼影高动态范围成像方法,针对目前无鬼影高动态范围图像方法存在的问题,利用参考图像与其余输入图像(非参考图)之间的梯度结构相似性可准确地判别出鬼影区域,并通过泊松图像编辑算法去除参考图像与其余输入图像之间存在移动物体的区域(鬼影区域),最后使用静态场景的多曝光高动态范围图像生成算法得到无鬼影的高动态范围图像。本发明不仅具有良好的鬼影去除效果,而且还能够生成高质量的图像。
📄 2018101825298
📂 G06T5_00
👤 电子科技大学
📅 2018-03-06