Progressive-Hint Prompting Improves Reasoning in Large Language Models

本文是LLM系列的文章,针对《Progressive-Hint Prompting Improves Reasoning

in Large Language Models》的翻译。

渐进提示改进了大型语言模型中的推理

  • 摘要
  • [1 引言](#1 引言)
  • [2 相关工作](#2 相关工作)
  • [3 渐进提示Prompting](#3 渐进提示Prompting)
  • [4 实验](#4 实验)
  • [5 结论](#5 结论)
  • [6 实现细节](#6 实现细节)
  • [7 不足与未来工作](#7 不足与未来工作)
  • [8 广泛的影响](#8 广泛的影响)
  • [9 具有不同提示的模型响应](#9 具有不同提示的模型响应)

摘要

大型语言模型(LLM)在推理任务中的性能在很大程度上取决于提示设计,思想链(CoT)和自洽性是增强这种能力的关键方法。然而,这些方法并没有充分利用LLM生成的答案来指导后续响应。本文提出了一种新的提示方法,称为渐进提示(PHP),通过使用以前生成的答案作为提示,逐步引导用户找到正确的答案,实现用户和LLM之间的自动多次交互。PHP与CoT和自一致性正交,因此可以轻松地与最先进的技术相结合,以进一步提高性能。我们在七个基准上进行了广泛而全面的实验。结果表明,PHP在保持高效的同时显著提高了准确性。例如,使用text-davinci-003,我们观察到与复杂CoT相比,贪婪解码的GSM8K改进了4.2%,自一致性的样本路径减少了46.17%。通过GPT-4和PHP,我们在SVAMP上实现了最先进的性能(89.1%→ 91.9%)、GSM8K(92%→ 95.5%)、AQuA(76.4%→ 79.9%)和数学(50.3%)→ 53.9%)。

1 引言

2 相关工作

3 渐进提示Prompting

4 实验

5 结论

6 实现细节

7 不足与未来工作

8 广泛的影响

9 具有不同提示的模型响应

具有不同提示的模型响应。当呈现提示100时,该模型准确地解决了该问题。相反,如果提供的提示与正确答案偏离太远,则模型可能会被误导。例如,当提示为0时,模型计算出未使用的胡萝卜量为80磅,输出的答案为0。

相关推荐
佛祖让我来巡山13 小时前
共鸣的灵魂:一个故事讲透AI是如何“理解”人类的
自然语言处理·llm·ai原理·自回归机制
quanjui18 小时前
【智能体从对话到决策】虚拟环境下大语言模型的部署与智能体交互研究
人工智能·语言模型·交互
刘婉晴19 小时前
【大模型安全】OWASP 大语言模型十大风险
人工智能·安全·语言模型
云和数据.ChenGuang19 小时前
深度学习完整技术路线图
人工智能·深度学习·机器学习·语言模型·自然语言处理
Husp07072 天前
Prompt入门到精通系列(一)
ai·语言模型
CodeLinghu2 天前
LangSmith Evaluate实战评估Agent
人工智能·python·语言模型·llm
m沐沐2 天前
【自然语言处理】词向量转换与中文文本情感分类——从CountVectorizer到朴素贝叶斯
人工智能·算法·机器学习·自然语言处理·分类·中文分词·词向量转换
howdoyoudo2026062 天前
AI审计手记 #10:当Google Earth变成谣言工厂——AI卫星图功能48小时失控始末
人工智能·安全·ai·语言模型
zzm6282 天前
多智能体对话中自然语言的涌现条件 —— EMNLP 2017最佳短论文解读
自然语言处理
workflower2 天前
高质量数据集的类型
人工智能·机器学习·设计模式·自然语言处理·机器人