利索能及
我要发布
收藏
专利号: 2022108852606
申请人: 武汉纺织大学
专利类型:发明专利
专利状态:已下证
更新日期:2026-08-19
缴费截止日期: 暂无
联系人

摘要:

权利要求书:

1.一种基于多模态信息的服装草图到图像生成方法,其特征在于,包括以下步骤:

步骤1、将服装图像输入训练好的服装图像分层编码模型,利用服装图像分层编码模型将服装图像处理得到服装局部信息与服装全局信息,并利用对应的基向量空间分别将服装局部信息与服装全局信息进行向量量化,得到服装的全局信息编码与服装的局部信息编码;

将服装草图输入草图编码模型,得到草图编码;

将文本输入输入文本编码模型,得到文本编码;

服装图像分层编码模型的训练方法包括以下步骤:

步骤1.1、将图像x输入编码器E,编码器E将图像x下采样到原来的1/4大小,得到包含细节信息的局部特征图 然后继续下采样到原来的1/8得到包含全局信息的全局特征图求Zglobal的方法为:对于全局特征图Zglobal中位置(i,j)的每个向量,量化器q(·)通过最近邻算法在Vglobal中找到与之最接近的向量ek并进行替换得到Zglobal;求Zlocal的方法为:将Zglobal上采样到与Zlocal相同的尺寸并与其进行残差连接,得到新的融合特征,然后通过最近邻算法在Vlocal中找到该融合特征图中每个位置最接近的向量ek并进行替换,得到Zlocal;

步骤1.2、将局部特征图Zlocal输入局部基向量空间Vlocal,得到服装的全局信息编码Zlocal,将全局特征图Zglobal输入全局基向量空间Vglobal,得到服装的全局信息编码Zglobal;

步骤1.3、将服装的全局信息编码Zlocal和服装的全局信息编码Zglobal输入到解码器D,得到重建图像:x'=D(Zlocal,Zglobal)步骤1.4、利用判别器计算总损失函数L=Lencoding+Lfm,其中Lfm为判别器所有层损失值的平均值,计算判别器第k层损失值的公式为: 其中N是判别器第k层的特征数, 为第k层判别器提取图像x的第i个特征;

其中

2

为求L2范数,||·||为求均方误差损失,sg[]表示停止梯度传播,停止更新该部分参数;通过最小化总损失函数对编码器E、局部基向量空间Vglobal、全局基向量空间Vglobal、解码器D和判别器的参数进行训练,训练完毕后得到训练好的服装图像分层编码模型;步骤2、将草图编码和文本编码共同构成条件信息,与服装全局信息编码连接共同输入Transformer‑G,Transformer‑G中的掩码注意机制自动生成服装全局信息序列;将服装图像的全局信息编码作为条件信息,与服装的局部信息编码连接共同输入Transformer‑L,自动生成服装局部信息序列;

其中,Transformer‑L用于生成服装细节信息编码,Transformer‑G用于生成服装全局信息编码;步骤3、将生成的服装全局信息序列与服装局部信息序列分别在对应的基向量空间中找到对应的向量并分别转换为全局二维特征图和局部二维特征图,将全局二维特征图和局部二维特征图输入到训练好的解码器D生成最终图像。

2.根据权利要求1所述的基于多模态信息的服装草图到图像生成方法,其特征在于,所述步骤3中,Transformer‑G和Transformer‑L用于采用自回归预测的方法生成服装序列。