GAN卷土重来:10亿参数的GigaGAN效果堪比扩散模型


【资料图】

点蓝色字关注“机器学习算法工程师”

设为星标,干货直达!

自从 DALL·E 2 之后,在图像生成方面扩散模型替代GAN成了主流方向,比如开源的文生图模型stable diffusion也是基于diffusion架构的。近日, Adobe研究者在论文Scaling up GANs for Text-to-Image Synthesis提出了参数量为10亿(1B)的GAN模型:GigaGAN,其在文生图效果上接近扩散模型效果,而且推理速度更快,生成512x512大小图像只需要0.13s,生成16M像素图像只需要 3.66s。同时GigaGAN也支持latent空间的编辑功能,比如latent插值,风格混合,以及向量运算等。

GigaGAN改进了StyleGAN架构,采用两阶段训练策略:一个是64x64的图像生成器和一个512x512的图像超分2器,其图像生成器架构如下所示(这里也是采用CLIP text encoder来引入text condition):GigaGAN在 LAION2B-en和 COYO-700M数据集上训练,其在COCO数据集上的FID达到9.09,超过stable diffusion 1.5,推理速度比stable diffusion快20倍多(2.9s vs 0.13s):GigaGAN除了文生图能力,还可以实现可控的合成,比如风格混合,如下图所示:更多效果图和技术细节见论文https://arxiv.org/abs/2303.05511和网站https://mingukkang.github.io/GigaGAN/

关键词:

为您推荐

GAN卷土重来:10亿参数的GigaGAN效果堪比扩散模型

点蓝色字关注“机器学习算法工程师”设为星标,干货直达!自从DALL·E2之后,在图像生成方面扩散模型替代GAN成了主流方向,比如开源的文生图模

来源:程序员客栈2023-04-08

公司美国银行有存款吗?潜能恒信:有:全球要闻

每经AI快讯,有投资者在投资者互动平台提问:您好,请问公司美国银行有存款吗?潜能恒信(300191 SZ)3月31日在投资者互动平台表示,有。

来源:每日经济新闻2023-04-08

那个不为人知的故事结局8个字_那个不为人知的故事结局|动态

1、其实,个人感觉三条线的结局都让FATE的故事落下帷幕。2、首先,三条线最后,圣杯都是最后都被破坏了,而FATE这个故

来源:互联网2023-04-08

一季就完结的五部高分美剧,部部都是好评如潮,一部没看太遗憾

第一部《兄弟连》豆瓣:9 6主演:戴米恩·路易斯 唐尼·沃尔伯格 朗·里维斯顿剧情点评:本剧制作精良、高度写实,依托美军前线士兵的视角,展

来源:圆头讲电影2023-04-08

橐皋

1、橐皋,读音tuógāo,汉语词语,指地名。2、春秋吴邑。3、即今安徽巢湖市西北柘皋镇。4、《春秋》哀公十二年(

来源:互联网2023-04-08

狗狗发烧的症状(狗狗可能会出现发烧的症状)

在饲养狗狗的过程中,狗狗可能会出现发烧的症状,一旦狗狗发烧之后,会出现精神不振。平时特别活泼的狗狗,突然不爱动,也不像平常一样喜欢玩

来源:互联网2023-04-08

马特里谈国米被绝平:传中相当慢且没压力,奥纳纳完全有时间接球:报道

DAZN评论员、前意甲中场瓦隆-贝赫拉米称:“他有很多时间来计算轨迹。”马特里表示:“奥纳纳没有受到来自前锋的压力,对我来说,他本可以后退

来源:直播吧2023-04-08

股票行情快报:中原环保(000544)4月7日主力资金净买入157.47万元

截至2023年4月7日收盘,中原环保(000544)报收于6 36元,上涨0 32%,换手率0 45%,成交量4 39万手,成交额2788 12万元。

来源:证券之星2023-04-08