返回报告库

AI / Technology

扩散概率模型把图像生成拆成很多个小去噪步骤

关于这篇论文的三个关键问题

扩散概率模型:把图像生成拆成很多个小去噪步骤 解决了什么问题?

直接从随机数跳到一张自然图像,是一个跨度很大的映射。2020 年前后的主流路线各有明显取舍:GAN 能生成锐利图像,但依赖生成器与判别器的对抗训练;自回归模型把图像按像素或通道顺序逐项生成,似然建模清楚,却受到固定生成顺序的约束;VAE 和流模型则在样本质量、似然与结构限制之间权衡。

扩散概率模型:把图像生成拆成很多个小去噪步骤 的核心结论有哪些证据?

最强结果来自无条件 CIFAR-10:论文报告 Inception Score 9.46、FID 3.17。需要注意,3.17 是相对训练集计算的 FID;相对测试集计算时为 5.24。作者还在 256×256 的 LSUN 上报告了与 ProgressiveGAN 相近的样本质量,但不同类别并非全面领先:例如附录表 3 中,本方法在 Bedroom、Church、Cat 上的 FID 分别为 6.36、7.89、19.75,而 ProgressiveGAN 为 8.34、6.42、37.52。【来源:摘要;第 4.1 节;附录表 3】

阅读 扩散概率模型:把图像生成拆成很多个小去噪步骤 时最需要注意什么局限?

最强结果来自无条件 CIFAR-10:论文报告 Inception Score 9.46、FID 3.17。需要注意,3.17 是相对训练集计算的 FID;相对测试集计算时为 5.24。作者还在 256×256 的 LSUN 上报告了与 ProgressiveGAN 相近的样本质量,但不同类别并非全面领先:例如附录表 3 中,本方法在 Bedroom、Church、Cat 上的 FID 分别为 6.36、7.89、19.75,而 ProgressiveGAN 为 8.34、6.42、37.52。【来源:摘要;第 4.1 节;附录表 3】

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro