摘要
本发明属于图像处理技术领域,公开一种基于多尺度动态注意力的树木图像语义抠图的方法,该方法首先对原始树木图像进行预处理,并编码目标边界框信息作为空间位置嵌入特征;随后通过语义感知编码模块提取图像的多层级语义特征,并与空间位置嵌入特征融合,形成增强的多尺度语义特征集合;将该特征输入动态增强抠图模块,借助U‑Net主干网络进行特征提取与还原,在瓶颈层嵌入多尺度动态空间注意力模块以自适应增强关键特征,同时在解码路径并行集成自适应边缘增强模块,以细化复杂边缘结构;最终融合多尺度特征生成高质量透明度遮罩。本发明通过多尺度动态注意力与自适应边缘增强的协同机制,有效提升了树木图像中复杂边缘与半透明区域的抠图精度。