【AI落地】AI生成测试用例,claude or gpt?(提效至少 50%)

结论: // 完整性 & 准确性:

Claude3.5 > GPT-4 > GPT-3.5

一、生成用例的提示词效果

常见的产品需求,有以下3种情况

o1、纯文字,不带图片

o2、文字,带图片

o3、纯图片

使用同一套提示词,效果:o1==o2>03

二、生成用例的过程

o1、提示词中加入相关需求

o2、提交给大模型(claude-3.5-sonnet),生成一个初版用例

o3、大模型生成的用例,复制到本地,添加到本地用例excel里

o4、本地优化用例excel

o5、提交到测试用例平台

注: 用excel,是因为公司内部使用 excel 上传管理用例。(可通过提示词修改)

三、生成用例的完整提示词,以及这套提示词的编写思路

1、生成用例完整提示词
bash 复制代码
你是一个测试工程师,编写测试用例时,需要考虑测试前期数据准备、基础功能、性能、压力、异常、兼容性以及用户体验性。

如果这是一个后台需求,需要考虑以下2种情况:
1、后台配置修改后,对H5页面的数据影响;
2、后台配置修改后,对后台历史配置数据的影响

如果这是一个H5需求,还需要考虑:
1、接口下发数据更新后,对H5页面的数据影响;
2、接口服务异常,对H5页面的影响


针对以下需求,生成测试用例:
{this is requirements content 在这里粘贴需求原文}

输出要求如下:
1、输出一份csv格式测试用例,字段包括模块、用例描述、所属端,分隔符使用分号。
2、模块部分要求根据功能和交互进一步细分
3、用例描述中,需要包括用例详细描述和对应的预期结果,需要考虑到接口字段交互,展示内容和对应字段
4、所属端字段值包括:客户端、服务端
2、提示词的编写思路

首先这套提示词不是最终形态,也不会返回最完美的效果。

因为编写 prompt 也是一个持续迭代优化的过程。

(1)提示词要素&规则
  • 简洁、明确、具体
  • 给个身份&案例(role background 设定背景场景)
  • 做什么/输出什么(指定输入输出)
  • 精确(要/不要)

上面的提示词基本就是按照这个思路写的,其中指定输入输出其实还可以继续优化 or 根据业务需求场景更改。

(2)一个更全面的学习编写提示词的课程 -> promptingguide

我使用这套提示词,最近几个月基本是大杀四方,快乐无边哈哈哈哈。

如果你用的效果不佳,可以试试改一下提示词,明确你的预期,让大模型给你返回你想要的。

事在人为,不要因为大模型的不完美否定大模型呀!

相关推荐
TMT星球1 分钟前
萤石亮相IFA 2026,多款AI创新产品集中展示,全球化智能生活体验引关注
大数据·人工智能·生活
知了一笑2 分钟前
Token消费不为结果买单
人工智能·aigc·token
deepdata_cn2 分钟前
机器学习≠逻辑推理!分清统计AI与符号AI
人工智能·机器学习
大鹏的NLP博客3 分钟前
拆解 Agent Memory:从认知心理学映射到工业级工程落地
人工智能·agent·memory
蓝速科技5 分钟前
固定涉外场景台式翻译机选型与落地指南
网络·人工智能·自然语言处理·语音识别·技术分享
棣廷6 分钟前
初识OpenCV——特征匹配与综合实战
人工智能·opencv·计算机视觉
aneasystone本尊6 分钟前
学习大模型推理的两个阶段:Prefill 与 Decode
人工智能
Tiansan66668 分钟前
郑州AI问答推广:精准获客背后的3大关键
人工智能·郑州ai问答推广精准
梦想的颜色8 分钟前
2026 年 9 月国内外主流大模型横向硬核评测:价格、算力、业务场景全维度对比,GPT‑6 Astra横空出世
gpt·claude·glm·minimax·kimi·deepseek·大模型测评
独码侠10 分钟前
FunASR语音识别生产部署实战:511MB音频47秒转写,离线落地 8 步、7 坑一次说清
人工智能·音视频·语音识别·funasr·说话人分离·会议纪要·内网离线部署