返回报告库

AI / Technology

零样本文本到图像生成

关于这篇论文的三个关键问题

零样本文本到图像生成 解决了什么问题?

论文追问的是:限制因素会不会主要是数据规模和模型规模,而不是缺少更复杂的专用技巧?为检验这一点,作者没有在 MS-COCO 的训练标签上微调模型,而是直接用互联网图文对训练,再做零样本评估。这里的“零样本”指没有使用目标基准的训练文本标签来适配模型,不是“训练时完全没见过相关视觉概念”。

零样本文本到图像生成 的核心结论有哪些证据?

在 MS-COCO 文本上与 DF-GAN 做五选一人评时,该模型的图像被选为更真实 的比例是 90.0%,被选为更符合文本 的比例是 93.3%。它的 FID 与当时最佳专用方法相差不到 2 分,而且没有使用 MS-COCO 的训练文本标签。论文第 7 页,图 7、图 9(a)

阅读 零样本文本到图像生成 时最需要注意什么局限?

在 MS-COCO 文本上与 DF-GAN 做五选一人评时,该模型的图像被选为更真实 的比例是 90.0%,被选为更符合文本 的比例是 93.3%。它的 FID 与当时最佳专用方法相差不到 2 分,而且没有使用 MS-COCO 的训练文本标签。论文第 7 页,图 7、图 9(a)

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro