【大模型LLM学习】天池Deep Research Agent开发赛

前言

  • 运气不错,这次压线前10,不过和top还是有差距的
  • 数据包括问题和答案可以在比赛官网获取,包括初赛的100题和复赛100题。赛题为输入query输出answer,通过搭建Search Agent,分解问题、多跳搜索识别线索,找到最佳答案,并用题目要求的规范格式进行回答,题目和答案例如
python 复制代码
"question": "一位物理学领域的学者为一种经典棋盘游戏设计的评分系统,后来被一家北美游戏公司广泛应用于其一款多人在线战术竞技游戏中。这家公司的母公司是一家亚洲科技巨头,该巨头在21世纪10年代完成了对前者的全资收购,并涉足量子计算等前沿科技领域。在这家北美公司开发的另一款第一人称射击游戏中,有一件适合近距离作战的武器,其名称与上述亚洲巨头代理发行的一款格斗手游中的一名在登场角色中年龄偏大的武术教官角色相同。这款格斗手游的名字是什么?"
"answer": "魂武者"
  • 答案规则:赛题的答案,如果是实体,取名顺序为百度百科>英文wiki>中文wiki,没有特殊说明情况下,答案语言和题目语言一致
  • 可以参考的解决方案:阿里的deepresearch
  • 比赛限制为,LLM上只能使用阿里的大模型API,禁止微调模型。可以使用Google/bing/阿里IQS等web search(网络搜索api的普通搜索模式)和jina,禁止调用Tavily的websearch;每个问题总时长要求10分钟以内

方案

  • 链接:https://github.com/DXWEIE/tianchi_deepresearch_agent
  • 架构:ReACT + Best of N
  • 搜索引擎:中文使用DDGS、阿里IQS;英文在此基础上使用google;同时如果触发了wiki搜索,分别使用wikipedia和阿里IQS(搜"xxx 百度百科")

经验记录

  • 先把最简单的react跑通,然后再尝试提升效果
  • qwen3.5的效果一般,速度也比较慢,优先使用qwen3-max>qwen3.5>qwen3-plus
  • 先提升单个链路的能力,最后再尝试并发多rollout然后merge结果取best的
  • 后续等看完top的代码更~
相关推荐
weiwin1232 小时前
MAF 入门(5):多 Agent 编排全解
人工智能·agent
DigitalOcean3 小时前
砍掉 60% AI 推理成本:深度解构 DigitalOcean 推理路由器的 MoE 门控与智能分流机制
llm·aigc·agent
AndrewHZ3 小时前
【LLM技术全景】大模型能力探秘:In-Context Learning与思维链(CoT)
人工智能·语言模型·大模型·llm·cot·思维链·icl
Vergelight3 小时前
实战拆解|三类RAG架构差异:朴素、进阶、多轮RAG落地选型指南
架构·大模型·aigc·agent·ai产品经理·转行·ai后台设计
o_insist4 小时前
LangGraph 入门:用 StateGraph 构建 Agent 的五步流程
人工智能·agent
枫子有风4 小时前
LLM-Agent智能体(大厂面试常问)
面试·职场和发展·llm·agent
昵称好难啊5 小时前
7.OpenClaw源码解析——可靠消息投递
人工智能·llm·agent
爱卜大王5 小时前
第 15 章:修复加固与回归:把前面的能力变成质量门
agent
云烟成雨TD5 小时前
Agent Scope Java 2.x 系列【19】Harness:从零搭建 MySQL 文件系统
java·人工智能·agent
问道飞鱼6 小时前
【大模型相关】意图识别实现方案行业分析报告
大模型·意图识别