AI测试用例检查

1. 入口与路由

  • HTTP:POST /api/v1/test-case/check/consistency(在 api.py 里挂到 prefix="/test-case/check")。
  • 实现文件:backend/app/api/v1/endpoints/check.py
  • 前端:frontend/src/views/test-case/check/index.vue 优先带 ?stream=true 走 SSE 式流式;失败时再 request.upload 到同一路径(不传 stream,相当于非流式)。

2. 三条执行路径(由查询参数决定)

条件 实际做的事
stream=true(页面主路径) StreamingResponse_check_with_stream:AutoGen 的 AssistantAgent + DeepSeek 客户端,model_client_stream=True,把 chunk 打成 data: {...}\n\n 推给前端。
use_agent=true(前端默认不传,一般为 false) _check_with_agent:试图用 agent_factory.create_agent(AgentTypes.TEST_CASE_CHECKER) 创建 TestCaseCheckerAgent,并往 SingleThreadedAgentRuntimeregister_agent。当前代码里 若运行时不存在 register_agent会直接降级 到下面的「旧方法」。
默认(stream=falseuse_agent=false _check_with_legacy_method:同样是 AssistantAgent + DeepSeek,on_messages 一次性拿完整回复再解析 JSON。

因此:日常从页面点「检查」时,主要是流式路径;兜底是非流式的「直接 LLM」路径。
TestCaseCheckerAgent 只有在显式 use_agent=true 且运行时支持 register_agent 时才会真正跑通;否则会在 check.py 里降级到 _check_with_legacy_method


3. 用了哪个「智能体」

  • 名义上的业务智能体:TestCaseCheckerAgentbackend/app/agents/test_case/test_case_checker_agent.py),在工厂里注册为 AgentTypes.TEST_CASE_CHECKERapp/agents/factory.py)。
  • 实际承担推理的组件(流式 / 非流式主路径):都是 AutoGen AssistantAgent,名字在代码里写死为 "consistency_checker",并不是多智能体编排,而是 单助手 + 一次大模型调用。
  • TestCaseCheckerAgent 内部:若被调用,会通过 BaseAgent 发进度/流式片段,核心对比仍是对 get_deepseek_model_client()create_stream,再本地拼 JSON 解析。

4. 调用了哪些模块(按数据流)

  1. 上传与解析(CPU 密集丢线程池):app.utils.file_parser --- parse_docxparse_pdfparse_xmindextract_text_from_xmind
  2. 消息模型(仅智能体路径):TestCaseCheckRequest / TestCaseCheckResponse 等 --- app.core.messages.test_case
  3. 工厂(仅 use_agent 路径):agent_factory --- app.agents.factorycreate_agent 对非图类智能体默认会注入 get_deepseek_model_client()
  4. 流收集(仅 use_agent 路径):StreamResponseCollector --- app.core.agents.collector
  5. 大模型:get_deepseek_model_client --- app.core.llms(基于 autogen_ext.models.openai.OpenAIChatCompletionClient)。
  6. AutoGen:AssistantAgentTextMessageCancellationToken;流式路径还用 ModelClientStreamingChunkEvent;智能体路径用 SingleThreadedAgentRuntimeTopicIdTopicTypes 等。

5. 用的是什么大模型

  • 提供商 / 协议:DeepSeek 的 OpenAI 兼容接口(DEEPSEEK_BASE_URL,默认 https://api.deepseek.com/v1)。
  • 模型名:配置为 deepseek-chat(见 get_deepseek_model_client)。
  • 密钥:仅 DEEPSEEK_API_KEY(与你在项目里「只用 DeepSeek」的设定一致)。
  • 超时:用例检查里常量 CHECK_LLM_TIMEOUT = 420秒(7 分钟) 传给 get_deepseek_model_client;智能体路径若走通,还有 asyncio.wait_for(..., 60) 等待最终回调的上限(与 LLM 7 分钟是不同层)。

6. 内容截断

  • 流式 / legacy:CHECK_CONTENT_LIMIT = 35000 字符,PRD 与用例各截断后再拼进 prompt。
  • TestCaseCheckerAgent:内部 max_content_length 为 50000(若智能体路径生效,截断策略与上面两条略有不同)。

架构图

"真实生效"的主链路是 前端 stream=true → 后端 _check_with_streamAssistantAgentDeepSeek(deepseek-chat) → SSE 回前端。

相关推荐
sel_92 分钟前
【多轮对话论文导读(二)】多轮对话与LLM Agent论文阅读:长期记忆、多轮评估与Agent训练
人工智能·深度学习·算法·语言模型·自然语言处理
NineData3 分钟前
DTCC 2026 NineData 叶正盛:如何统一管理人与 AI Agent 的数据访问行为
数据库·人工智能·sql·oracle·agent·ninedata·dtcc
bulingg4 分钟前
模型架构与机制:Encoder-only vs Decoder-only vs Encoder-Decoder
人工智能
天远Date Lab6 分钟前
零信任架构实战:基于天远普通维保查询构建自动化车辆收车评估网关
运维·人工智能·架构·自动化
记忆张量MemTensor13 分钟前
MemOS Skill 上线|一句话即可接入 MemOS Cloud
大数据·数据库·人工智能·typescript·开源
H03111698514 分钟前
关于AI会议音视频转写与智能生成纪要工具的对比分析
人工智能·音视频
视跃科技17 分钟前
多路视频实时解码推理,是怎么做到“逐帧解码 + AI检测 + 目标框叠加上墙“的?
人工智能·目标跟踪·音视频
嘻嘻的AI日记25 分钟前
多库设置+自主选库检索,重塑智能知识管理体系
人工智能
华万通信king28 分钟前
GEO实战:用 llms.txt 给官网打“AI友好“地基(附配置示例)
人工智能·geo
AI云海32 分钟前
深度学习_全连接网络实现回归任务
人工智能·深度学习·回归