论文标题:Anycost GANs for Interactive Image Synthesis and Editing 论文链接:https://arxiv.org/abs/2103.03243 代码链接:https://github.com/mit-han-lab/anycost-gan 作者单位:MIT(韩松团队) & Adobe(朱俊彦等) & CMU 可以各种成本预算(最多将计算量减少10倍)执行,并适应各种硬件和延迟要求,性能优于StyleGAN2、MSG-GAN等,代码在8小时前刚刚开源!
生成对抗网络(GAN)使得能够实现逼真的图像合成和编辑。但是,由于大型生成器(例如StyleGAN2)的计算成本较高,通常需要几秒钟才能在边缘设备上看到单个编辑的结果,从而禁止了交互式用户体验。在本文中,我们从现代渲染软件中汲取了灵感,并提出了Anycost GAN用于交互式自然图像编辑的建议。我们训练Anycost GAN以支持弹性分辨率和通道,以多种速度更快地生成图像。运行完整生成器的子集所产生的输出在感觉上与完整生成器相似,从而使它们成为预览的良好代理。通过使用基于采样的多分辨率训练,自适应通道训练和生成器条件的鉴别器,与单独训练的模型相比,可以在各种配置下评估anycost生成器,同时获得更好的图像质量。此外,我们开发了新的编码器训练和潜在代码优化技术,以鼓励图像投影期间不同子生成器之间的一致性。 Anycost GAN可以以各种成本预算(最多可将计算量减少10倍)执行,并适应各种硬件和延迟要求。当部署在台式机CPU和边缘设备上时,我们的模型可以以6至12倍的速度提供与感觉相似的预览,从而实现交互式图像编辑。
内容中包含的图片若涉及版权问题,请及时与我们联系删除



评论
沙发等你来抢