激光网
当前位置: 首页 > 人工智能 > 正文

腾讯AI实验室在姿态引导人物图像合成方面取得重大突破

2023-11-04 21:48:23  来源:IT之家    

  腾讯 AI 实验室近日推出了渐进式条件扩散模型(PCDMs),在姿态引导人物图像合成方面取得重大突破。

  

 

  PCDMs 由先验条件扩散模型、修复条件扩散模型和完善条件扩散模型三个关键阶段组成,解决了应对源图像与目标图像的姿态不一致问题,以及在生成高质量、逼真图像方面的挑战。

  PCDMs 在 DeepFashion 和 Market1501 数据集上的各项指标,明显优于其他 SOTA 方法,且在小尺度数据集 Market1501(128*64)上的 SSIM 指标得到最高的 0.3169,比第二名 PIDM 高出 3.8%。

  在先验条件扩散模型第一阶段,在给定源图像和姿势坐标作为条件的情况下,先验条件扩散模型采用一个变换网络来预测目标姿势下的全局特征。

  在修复条件扩散模型第二阶段,进一步完善第一阶段的全局特征,建立源图像和目标图像之间密集对应关系,该阶段可确保跨多个维度(包括图像、姿势和特征)进行对齐,对于实现逼真的结果至关重要。

  在完善条件扩散模型第三阶段:在前一阶段生成初始粗粒度目标图像后,细化条件扩散模型介入以提高图像质量和纹理细节。

  此阶段利用先前生成的粗粒度图像作为条件,进一步提高图像保真度并确保纹理一致性,涉及修改第一个卷积层,并使用图像编码器从源图像中提取特征。采用交叉注意力机制将纹理特征注入网络,便于纹理修复和细节增强。

免责声明: 激光网遵守行业规则,本站所转载的稿件都标注作者和来源。 激光网原创文章,请转载时务必注明文章作者和来源“激光网”, 不尊重本站原创的行为将受到激光网的追责,转载稿件或作者投稿可能会经编辑修改或者补充, 如有异议可投诉至:Email:133 467 34 45@qq.com