【AI落地】AI生成测试用例,claude or gpt?(提效至少 50%)

结论: // 完整性 & 准确性:

Claude3.5 > GPT-4 > GPT-3.5

一、生成用例的提示词效果

常见的产品需求,有以下3种情况

o1、纯文字,不带图片

o2、文字,带图片

o3、纯图片

使用同一套提示词,效果:o1==o2>03

二、生成用例的过程

o1、提示词中加入相关需求

o2、提交给大模型(claude-3.5-sonnet),生成一个初版用例

o3、大模型生成的用例,复制到本地,添加到本地用例excel里

o4、本地优化用例excel

o5、提交到测试用例平台

注: 用excel,是因为公司内部使用 excel 上传管理用例。(可通过提示词修改)

三、生成用例的完整提示词,以及这套提示词的编写思路

1、生成用例完整提示词
bash 复制代码
你是一个测试工程师,编写测试用例时,需要考虑测试前期数据准备、基础功能、性能、压力、异常、兼容性以及用户体验性。

如果这是一个后台需求,需要考虑以下2种情况:
1、后台配置修改后,对H5页面的数据影响;
2、后台配置修改后,对后台历史配置数据的影响

如果这是一个H5需求,还需要考虑:
1、接口下发数据更新后,对H5页面的数据影响;
2、接口服务异常,对H5页面的影响


针对以下需求,生成测试用例:
{this is requirements content 在这里粘贴需求原文}

输出要求如下:
1、输出一份csv格式测试用例,字段包括模块、用例描述、所属端,分隔符使用分号。
2、模块部分要求根据功能和交互进一步细分
3、用例描述中,需要包括用例详细描述和对应的预期结果,需要考虑到接口字段交互,展示内容和对应字段
4、所属端字段值包括:客户端、服务端
2、提示词的编写思路

首先这套提示词不是最终形态,也不会返回最完美的效果。

因为编写 prompt 也是一个持续迭代优化的过程。

(1)提示词要素&规则
  • 简洁、明确、具体
  • 给个身份&案例(role background 设定背景场景)
  • 做什么/输出什么(指定输入输出)
  • 精确(要/不要)

上面的提示词基本就是按照这个思路写的,其中指定输入输出其实还可以继续优化 or 根据业务需求场景更改。

(2)一个更全面的学习编写提示词的课程 -> promptingguide

我使用这套提示词,最近几个月基本是大杀四方,快乐无边哈哈哈哈。

如果你用的效果不佳,可以试试改一下提示词,明确你的预期,让大模型给你返回你想要的。

事在人为,不要因为大模型的不完美否定大模型呀!

相关推荐
β添砖java2 分钟前
深度学习31注意力机制、注意力分数、使用注意力机制的seq2seq、自注意力
人工智能·深度学习
ZGIAI8 分钟前
销售团队最缺的不是另一个 AI,而是有人把跟进这件事一直做下去
人工智能·架构
隔窗听雨眠23 分钟前
MCP会成为Agentic AI的标准吗?技术演进、生态博弈与标准之路的深度分析
人工智能
2601_9676598825 分钟前
2026年多个网页快速提取重点、自动汇总、对比并整理成表格的AI工具清单
人工智能
IT古董29 分钟前
AI资讯日报|2026年9月5日:GPT-6 Astra全量推送却遭“翻车“,奥特曼紧急致歉一天12条大新闻:OpenAI翻车、英伟达收购、最狠AI法案出台
人工智能
chen_zn9531 分钟前
《WAM 系列》Zero-WAM | 人类视频上下文学习 | 未来片段预测 | 零样本跨任务泛化
人工智能·具身智能·vla
airank36 分钟前
2026年GEO服务商选型指南:系统梳理服务商分类框架、主流服务商能力横评、企业级选型六大维度及避坑要点,帮助企业在AI搜索时代做出科学决策。
大数据·人工智能·数据分析·aigc
Delite80243 分钟前
摆脱实验室束缚:便携式卡尔费休微量水分检测技术与现场应用解析
大数据·网络·人工智能
Jialu.1 小时前
模型压缩实战:BERT 量化从 390MB 到 146MB 的实践
人工智能·深度学习·bert
袋鼠云数栈1 小时前
实时湖仓如何真正做到“数据够新”?
大数据·数据库·人工智能·数据治理