AI 应用评测平台

本次搭建的AI 应用自动化评测平台采用界面、接口、业务逻辑、数据存储完全解耦的四层架构,如图1所示,各层独立迭代、高效协同,实现模块解耦与功能复用,提升平台的扩展性与迭代效率,各层技术实现与功能定位如下:

  1. 前端展示层:基于 React+Vite+TypeScript+TanStack Router+TanStack Query 实现,包含智能体注册、评测集、评估器、实验管理、运行实验、日志界面 6 大功能模块,提供可视化操作入口;
  2. API 网关层:依托 FastAPI 实现 RESTful API,结合 WebSocket 完成实时通信,通过 JWT/OAuth2 实现认证授权,为前后端交互提供标准化、安全化接口;
  3. 核心服务层:基于 Python+FastAPI+Langfuse SDK+SqlModel 实现,采用多 Agent 协作架构,包含智能体 / 评测集 / 评估器管理、生成评测集、评估器、生成评测报告四大核心模块,是平台智能化能力的核心载体;
  4. 数据存储层:采用异构存储方案,MySQL 存储核心业务数据、RAG 存储业务知识库、ClickHouse 存储时序分析数据,实现不同类型数据的高效管理与检索。

实现效果:

新建评测集页

评测集列表页

评估器详情页

评估器列表页

实验管理页面

实验详情页面

实验日志界面

评测报告页面

相关推荐
JS菌8 小时前
手写一个 AI Agent 全栈项目:从沙箱执行到子智能体的完整实现
前端·人工智能·后端
lqqjuly8 小时前
前沿算法深度解析(二)
人工智能·算法·机器学习
Bode_20028 小时前
基于大数据分析的全生命周期质量追溯质量评估体系落地方案
大数据·人工智能
分布式存储与RustFS8 小时前
RustFS S3 Table 开源后,我重新梳理了一下 Iceberg 数据湖的选型思路
人工智能·开源·minio·dpu·rustfs·ai存储·s3 table
DevOpenClub9 小时前
用 Agent 搭建网页内容采集与结构化处理流水线
人工智能
56AI9 小时前
2026 企业级AI智能体开发平台推荐:聚焦底层安全与准确率的智能体平台
人工智能·安全·智能体
沫儿笙9 小时前
库卡弧焊机器人白车身焊接节气装置
人工智能·机器人
AI智图坊9 小时前
多件装组合SKU图的批量生产效率分析:从PS手工到AI自动化的工作流改造
大数据·运维·人工智能·gpt·ai作画·自动化·aigc
threelab9 小时前
Three.js 物理模拟着色器 | 三维可视化 / AI 提示词
开发语言·前端·javascript·人工智能·3d·着色器
RSTJ_162510 小时前
PYTHON+AI LLM DAY SEVENTY-ONE
人工智能