摘要
针对在复杂牛场环境下存在牛群遮挡、牛脸脏污以及牛的活动状态和姿态多样性等问题引起的牛身份识别困难的难题。本发明公开了一种基于Vision‑Transformer的复杂牛场环境牛脸识别算法。本发明在VIT模型的基础上对复杂牛场环境设计了全新的特征融合方式。在VIT模型中加入本发明提出的patch‑shift网络层,patch‑shift网络层中的shift模块融合特征之间信息,不仅利用了局部特征还融合了局部特征之间的信息,缓解了在牛场环境中脏污对识别的影响。加入可学习的Mask矩阵使模型抑制不含牛脸信息的图像块,抑制图像背景干扰,使模型更加关注图像中的牛脸特征,学习到更加鲁棒的牛脸特征。