大语言模型:Large Language Models Are Human-Level Prompt Engineers概述

研究内容

如何通过prompt,在不进行微调大语言模型的前提下,增加大语言模型的表现

研究动机

  • prompt非常有用,但是人工设置的非常不自然;
  • 因此提出了要自动使用大语言模型自己选择prompt;
  • 取得了很好的效果。

作者主要是提出了三件事:

如何让大语言模型生成prompt

LLM是可以分为两类的,

  • 其中一类GPT是只能从前到后的,他们不支持句子补全(在一段话当中填写空缺位置);
  • 另一类,则是可以反向的例如T5、GLM、 InsertGPT,这些模型就会支持句子补全。

因此作者为这两类模型分别设置了两种方法,例子如下:

同时作者指出,也不一定要和这俩完全相同,使用回答评价指标一定可以找到一个更加适合指令instruction生成的prompt这里只是样板(template)。作者给出了在本文实验当中实际采用的prompt:

如何评价这些prompt

就是简单的让其跑一下分

如何进一步优化prompt

可以使用大语言模型进一步resample跑一下选出来的高分指令instruction:

再在这些指令当做选择更好的指令。

相关推荐
宅小年6 分钟前
DeepSeek Harness 的插件,到底该怎么用?
人工智能
仙魁XAN13 分钟前
【WorkBuddy · 三件套:技能/专家/技能】第 17 章 · 配置 MCP 服务器
人工智能·workbuddy·workbuddy三件套·mcp 配置与使用
无忧.芙桃16 分钟前
AI 生产力工具实践(四):豆包如何成为日常学习与写作助手
人工智能
IT_陈寒24 分钟前
Python的GIL把我坑惨了,多线程跑得比单线程还慢
前端·人工智能·后端
L@ncor28 分钟前
第二章可能出现的问题
人工智能·python
XGeFei30 分钟前
【Skills:SQL Assistant】
人工智能·langchain
子非鱼eva38 分钟前
昇腾开源仓Issue分析解答-mindspore精选(一)
人工智能·ai
SL_staff39 分钟前
ERP排程总在纸上谈兵?JVS-APS如何用真实产能约束打通计划与执行闭环
java·人工智能·开源
jsl_jsl_jsl1 小时前
《Tauri 桌面端的 Vue 3 前端:瘦客户端 + SSE 流式消费的实现细节》
人工智能
七牛云行业应用1 小时前
GPT-6 Sol突发曝光?将于本周发布,从 API 线索、三弹实测到 OpenAI 的 RSI 竞速
人工智能·ai编程