DB-GPT 0.7.5 版本更新:基于 Falcon 评测集的Text2SQL评测体系全面升级,支持LLM/Agent两种评测模式和多环境评测

V0.7.5 版本主要新增、增强了以下核心特性

🍀基于 Falcon 评测集的 Text2SQL评测体系全面升级,支持LLM/Agent两种评测模式和多环境评测

🍀优化 Falcon 评测集的加载和支持动态多环境的问题集

🍀 新增 Neo4j 图数据库支持

🍀 支持Elasticsearch的全文检索

🍀新增 指标检索Agent 波动分析Agent增强数据分析能力

🍀新增 WebSerachAgent处理联网搜索场景

✨新特性

1.基于 Falcon 评测集的Text2SQL评测体系全面升级,支持LLM/Agent两种评测模式和多环境评测

a.支持 端到端评测LLM在Falcon评测集基准

b.支持评测自定义Agent在Falcon评测集准确率、可执行率

详细的使用文档见:

2.优化 Falcon 评测集的加载和支持动态多环境的问题集

  • Falcon评测集加载优化为运行时动态加载,且从Falcon仓库动态拉取最新问题集
  • 拆分为DEV/TEST多环境问题集,按需评测

3.新增 Neo4j 图数据库支持

扩展Neo4j 数据库,进一步提升 RAG在复杂知识关系处理上的能力

4.支持Elasticsearch的全文检索

在ES支持向量检索的基础上,新增全文检索能力,提升RAG的检索召回能力

5.DB-GPT新增 指标检索Agent**、** 波动分析Agent**、** WebSearchAgent****等Agent

🐞 Bug 修复

  • 修复benchmark结果对比中布尔值和空值结果比较问题 (#2967)
  • 修复Graph知识图谱文档加载错误问题 (#2966)
  • 修复知识图谱的参数丢失问题 (#2926)
  • 修复通过环境变量配置数据源时的错误 (#2924)
  • 修复Milvus向量数据库在工作流中使用错误 (#2933)
  • 解决 AWEL 工作流多窗口问题和应用信息丢失 (#2944)

🛠️其他

  • 更新文档中的一些书写错误 (#2964)
  • 调整benchmark问题集文件 (#2940)

✨官方文档地址

英文:

http://docs.dbgpt.site/docs/overview

中文:

https://www.yuque.com/eosphoros/dbgpt-docs/bex30nsv60ru0fmx

✨致谢

🎉新贡献者

V0.7.5 版本新增 5 位 新的贡献者:

  • @Hikomorebi
  • @ZhikunZheng
  • @lusains
  • @zhangyj21-lh
  • @ymx10086

🔥🔥感谢所有贡献者使这次发布成为可能!

@Aries-ckt , @Hikomorebi , @ZhikunZheng , @chenliang15405 , @dusx1981 , @huhao0926 , @liuhill , @lusains , @yaoyifan-yyf , @ymx10086 , @zhangyj21-lh and alan.cl

✨附录

相关推荐
智码看视界1 分钟前
Day49-AI微服务化-将大模型能力封装为标准微服务
java·微服务·ai·架构·大模型·sse流式输出·ai中台
不正经学生6 分钟前
C语言大小端字节序:内存里字节的排列顺序
c语言·开发语言·arm开发·c++·算法·c#
Francek Chen7 分钟前
【大数据处理与分析】数据仓库Hive:02 数据湖
大数据·数据仓库·hive·hadoop·分布式·数据分析
BOBY_KEJI9 分钟前
技术科普:AI迎宾机器人在超大型展馆的应用原理与功能优势
人工智能·机器人
IT小白杨20 分钟前
从Chromium重构到真实ARM云手机:多账号隔离方案的技术演进
大数据·经验分享·智能手机·重构·安全架构·指纹浏览器
GEO优化师-嘉文21 分钟前
惠州GEO优化实操案例:传统制造企业官网内容重构后,AI问答推荐率45天提升41%的完整拆解
人工智能·重构·制造
逻辑君26 分钟前
科技逆向外语|20260805
人工智能·科技·机器学习
IT_陈寒27 分钟前
SpringBoot这个特性差点让我加班到凌晨
前端·人工智能·后端
安逸sgr27 分钟前
激活函数有什么用?Sigmoid、Tanh、ReLU 到底怎么选?
人工智能·ai·大模型·agent·智能体
2401_8949155328 分钟前
Geo 优化源码部署避坑指南:解决访问异常、定位失效、收录卡顿问题
java·服务器·后端·缓存·开源