返回报告库

AI / Technology

思维链提示不是让模型变聪明,而是让它先把路走出来

关于这篇论文的三个关键问题

思维链提示:不是让模型变聪明,而是让它先把路走出来 解决了什么问题?

图 0:论文的核心不是换模型,而是在问题与答案之间示范一条可生成的中间路径。

思维链提示:不是让模型变聪明,而是让它先把路走出来 的核心结论有哪些证据?

在 PaLM 540B 上,GSM8K 准确率从标准提示的 17.9% 提升到 CoT 的 56.9%,超过论文采用的此前最佳 55.0%。加入只负责执行算术的外部计算器后,结果进一步达到 58.6%。同一张总表里,GPT-3 175B 从 15.6% 提升到 46.9%,Codex(code-davinci-002)从 19.7% 提升到 63.1%。

阅读 思维链提示:不是让模型变聪明,而是让它先把路走出来 时最需要注意什么局限?

部署层面还有两项限制:显著效果集中在当时非常大的模型,推理成本高;而部分核心模型并不公开,复现者虽然能拿到完整提示和部分输出,却无法完全重现实验环境。

今天还可免费读 2 篇新报告订阅 Pro 后无限阅读,并获得每月 10 篇新论文生成额度。升级 Pro