如何调试QWEN-1.8B模型的prompt来达到预期效果

这一段时间都在学习与预研大模型技术,目前采用的模型是用hugging-face上的Qwen-1.8B参数级别的模型, 本地部署启动, AMD 630 16G显卡,启动与推理都没什么压力

这几天碰到一个比较有意思的问题, 我想通过使用模型的NLP能力来进行意图分析,通过构造提示词模版来达到预期效果:

如图, 想让大模型按照我的提问来返回对应的答案,在实际使用场景中, 正确率只有50-60%左右,

很多时候会与模版中的希望返回的答案不匹配,同样的问题在通义千问的官网的回答基本都是准确的:

不知道有没有了解的大佬们看下到底是什么原因引起的这种问题,是要调整prompt还是要调整模型的参数?

相关推荐
七夜zippoe14 小时前
OpenClaw Prompt 工程:从角色设定到 Skill 封装的 Agent 输出质量方法论
java·服务器·prompt·openclaw·skill封装
神奇霸王龙17 小时前
2026旗舰六阶段MCP流水线实战指南
人工智能·ai·ai作画·prompt·aigc·mcp
安逸sgr17 小时前
如何减少 Prompt 引起的幻觉和答非所问?
人工智能·ai·大模型·prompt·agent·智能体
码云骑士18 小时前
85-Prompt是一门工程-结构化分层-System-vs-User-Prompt
python·prompt
Aloudata2 天前
Prompt 驱动分析 vs Skill 驱动分析:企业 AI 分析如何从会问走向可复用
大数据·人工智能·数据分析·prompt·skill·语义层
奈斯先生Vector2 天前
大模型 Agentic Workflow 架构解构:异构 API 调度与 Token 路由的多模态系统设计
开发语言·前端·架构·prompt·aigc·音视频
大模型momo2 天前
AI 编程工程化:从 Prompt 到 Harness
人工智能·prompt·编程·agent
方乐寺村2 天前
解密prompt系列. MCP - 工具演变 & MCP基础
网络·prompt
奈斯先生Vector2 天前
不再手写 Prompt 链:用工作流编译器构建可验证的多模型 Agent 运行时
prompt
IT小盘2 天前
12-Prompt不等于一句话-System-User-Context三层结构
java·windows·prompt