本发明提供了一种基于扩散模型的图像生成身份个性化方法,包括:步骤1,构建身份语义解耦训练框架:建立身份增强模型,所述身份增强模型在原始SDXL1.0模型上额外引入了图像交叉注意力模块;步骤2,建立混合注意力融合机制,然后进行混合注意力融合;步骤3,风格生成:在原始SDXL1.0模型的自注意力层中对键、值特征执行混合操作,即一种结合自适应均值归一化与均值对齐的操作,以进一步将合成图像的风格与输入的风格提示对齐。本方案在保持文本语义编辑能力的前提下,突破现有方法在身份一致性保持方面的局限,定制化生成双人图像,而且能够控制生成图像的风格,适用于数字内容创作、虚拟形象生成等需要精准身份控制的场景。
📄 202511471948X
📂 G06T3_04
👤 南京信息工程大学
📅 2025-10-15
本发明公开了一种面向虚拟试穿模型的对抗扰动生成主动防御方法,根据目标虚拟试穿模型风险等级,判断是否启用主动防御,若需启用,则构建语义感知引导模块,提取原始图像和对抗样本的深层语义特征,并构建语义感知损失函数来指导扰动分布方向;构建像素级攻击模块,构建了一个像素级损失函数,最大化每次迭代优化过程中正常输出与扰动输出之间的差异,从而实现对目标虚拟试穿模型的稳定干扰。构建多级相似性测量模块,将语义感知损失函数和像素级损失函数融合为整体优化目标函数,进一步增强干扰稳定性并提高攻击成功率,同时保持图像质量。本发明旨在生成视觉隐蔽、语义一致且攻击性强的对抗样本,实现对目标虚拟试穿模型的有效干扰。
📄 2026104167529
📂 G06T3_04
👤 南京信息工程大学
📅 2026-04-01
本发明公开了一种基于姿态引导、风格和形状特征约束的人体图像生成方法,包括:(1)采集获取源人体图像Is和目标人体图像It,计算其姿态图像Ps、Pt和人体语义分割图像Ss、St;(2)构建生成器G和判别器DI、DP;(3)将Is和Ss输入风格编码器,Pt输入姿态编码器,St输入形状编码器;把得到的风格特征、姿态特征和形状特征输入解码器中,获得虚拟目标人体图像If;(4)把(Is,It)和(Is,If)作为判别器DI的输入,把(Pt,It)和(Pt,If)作为判别器DP的输入,分别计算对抗损失,并基于If和It计算图像重建损失、感知损失和语义损失,优化G;(5)迭代训练,得到生成器G,进行人体图像生成的应用。利用本发明,可以按语义区域提取风格特征,控制人体图像的姿态和形状。
📄 2021104131257
📂 G06T3_04
👤 浙江工业大学
📅 2021-04-16
一种基于生成对抗网络的无监督多模态图像转换方法,包括以下步骤:1)同时输入属于A域图像xa以及属于B域图像xb进入图像跨域转换神经网络中;2)编码器将图像拆分编码为图像内容编码c以及域风格编码s;3)针对不同的域图像配置不同的特定域编码m;4)将内容编码c、域风格编码s和特定域编码m融合并解码,生成指定目标域图像;5)判别器对生成器生成的图像进行质量评判;6)按步骤1)~5)重复设定次数,直到网络收敛。本发明旨在没有互相匹配的图像数据情况下,利用深度学习技术,只需单个生成网络即可完成多域的图像生成,高效且有效地实现无监督图像跨域转换。
📄 2021103335492
📂 G06T3_04
👤 浙江工业大学
📅 2021-03-29
本发明公开了一种基于分层原理的云锦风格图像生成方法,图案部分,利用色彩优化后的局部风格迁移算法对图案进行迁移设计,获得云锦风格图;纹理部分,将云锦纹理分为底布、丝绒、特殊材料(金银线、孔雀羽)、间丝四类纹理。使用三维扫描仪获取云锦扫描图并提取出各类纹理的循环组织作为纹理合成单元。借助块拼接纹理合成算法将纹理单元转化成与云锦扫描图同尺寸的纹理合成图;使用Grabcut图像分割算法,获取迁移效果图的各类掩码图,结合掩码图与对应的纹理合成图,获得各类纹理层。将图层从下到上分别按照底布纹理层、丝绒纹理层、迁移效果图、特殊材料纹理层、间丝纹理层进行叠加,得到云锦风格图像。
📄 2022106099636
📂 G06T3_04
👤 浙江理工大学
📅 2022-05-31
本发明公开一种基于扩散模型和风格迁移的构造式信息隐藏方法,包括基于预设映射规则,将待隐藏的秘密信息映射为内容噪声;利用扩散模型对内容噪声去噪得到内容图像,再利用扩散模型对内容图像进行编码,得到内容图像注意力特征;利用扩散模型对风格图像进行编码,得到风格噪声和风格图像注意力特征;将风格噪声和内容噪声融合生成初始噪声,经扩散模型对初始噪声去噪,并分别注入对应的注意力特征生成含密图像,再注入对应的注意力特征还原初始噪声,利用逆融合计算出还原初始噪声的内容噪声,再通过逆映射规则提取内容噪声的秘密信息;本发明解决目前信息隐藏领域存在的含密图像质量不足、抗隐写分析性能不足问题。
📄 2026100855426
📂 G06T3_04
👤 南京信息工程大学
📅 2026-01-22
本发明公开一种化妆模拟控制方法、装置、计算机设备及存储介质,包括:获取用户图像信息以及所选择的化妆品信息,图像信息包括过滤了第一环境光参数的第一用户头像信息,化妆品信息包括化妆品型号;从预设数据库中提取与化妆品型号相映射的颜色参数以及使用的相对位置;将颜色参数叠加至过滤了第一环境光参数的第一用户头像信息的相应位置以得到模拟化妆图像。本申请通过对人体进行图像拍摄,可识别出人体的面部轮廓以及五官、肤色,同时读取拍摄装置的采集的环境光,以及拍摄装置的拍摄参数,对图像进行处理,还原出最真实的人体的肤色,在叠加了化妆品的颜色后以达到最贴近用户肤色化妆效果的图片,提高模拟化妆的真实性和准确性。
📄 201811349076X
📂 G06T3_04
👤 平安科技(深圳)有限公司
📅 2018-11-13
本发明公开了一种内容图像对象分离的风格迁移方法,包括:提取目标图像的风格图像和内容图像,以显著目标检测模块处理风格图像,区分风格主体对象与背景对象;构建深度估计机制,以深度估计模块处理内容图像,获取内容图像的深度信息;以卷积特征通道的风格分离属性为基础,提取风格主体对象的特征,并设计不透明度敏感的损失函数,得到风格化主体对象迁移结果;结合内容背景包含复杂对象的特点,以散焦与实例归一化为基础,调整其清晰度与风格信息,以得到风格化背景迁移结果;最后组合对象迁移结果。本发明在面对内容主体纷乱的内容图像时,通过深度估计机制,引导风格迁移模块实现风格迁移,有效解决了复杂场景风格迁移结果杂乱的问题。
📄 2024116422933
📂 G06T3_04
👤 南京信息工程大学
📅 2024-11-18
本发明公开一种基于人脸特征的图像调整系统及其方法,通过分析图像中是否存在人脸特征,并且将存在人脸特征的区域设为固定区域,以及将不存在人脸特征的区域设为调整区域,再分别根据固定区域及调整区域撷取相应的图像作为固定图像及调整图像,接着对调整图像进行图像运算处理以调整图像宽度,并且将固定图像及调整后的调整图像一并显示在横幅区块中,用以达成在不同显示比例的情况下,维持人物图像的显示质量的技术功效。
📄 2017112738693
📂 G06T3_04
👤 英业达科技有限公司,英业达股份有限公司
📅 2017-12-06
本发明公开了一种面向合成应用的多层次仿射类抠像方法。步骤1:利用基于HSV颜色空间的仿射类方法,针对实体像素计算初级αHSV值,并为后续步骤提供实体像素的先验值;步骤2:利用初级αHSV值、直接搜索、间接搜索与拟合性约束,针对混合像素计算初级前景Fpre与背景Bpre,并为后续步骤提供α与前景的混合像素的先验值;步骤3:利用步骤1的α与前景的混合像素的先验值,并引入联合性Laplacian抠像矩阵与拟合性约束,同步求出最终的α*与前景值F;步骤4:利用步骤3最终的α*与前景值F与新背景B′合成图像I′。本发明采用搜索范围更远的KNN仿射类求解方法取代最近邻方法,以期获取空间距离更远的样本。
📄 202010544350X
📂 G06T3_04
👤 哈尔滨晨汇科技有限公司
📅 2020-06-15
本公开涉及一种图像光照校正方法及装置、电子设备和存储介质。所述方法包括:获取待校正图像中各光照校正区域的期望亮暗等级;根据光源的参数和所述期望亮暗等级,确定各所述光照校正区域的校正值;根据各所述光照校正区域的校正值和所述待校正图像,生成所述待校正图像的光照校正图像。本公开实施例利用得到的校正值对待校正图像进行光照校正,能够满足不同精度的光照校正需求,光照校正过程用时短,光照校正效果合理、自然。
📄 2018112586106
📂 G06T3_04
👤 深圳市商汤科技有限公司
📅 2018-10-26
本发明公开了一种基于RAFT光流的视频风格迁移方法,属于视频处理技术领域,具体包括:通过RAFT光流网络逐帧计算视频中相邻帧的像素位移,生成包含每个像素运动方向和大小的光流场;根据光流场中像素的位移量生成动态权重图;将视频帧分解为低频结构层和高频细节层,对低频结构层进行全局风格迁移;对高频细节层结合动态权重图进行局部风格化;融合处理后的低频结构层和高频细节层,生成单帧风格化图像;根据光流场将当前帧的风格化结果与相邻帧进行运动对齐,通过反向投影和插值补偿调整像素位置;将对齐后的多帧结果进行时序平滑滤波,输出连贯的风格化视频;本发明提升视频帧间的时间一致性和运动流畅性。
📄 2025104809418
📂 G06T3_04
👤 南京信息工程大学
📅 2025-04-17