Agent-Tool Use

之前我们学习了Agent里的RAG和Memory,但还有一个很关键的部分一直没细讲,那就是Tool Use(工具调用)。

Tool Use

其实很多人第一次接触Agent时,会以为"会调用API"只是一个附加功能,但实际上,工具调用才是真正让Agent从聊天工具变为能做事的机器的关键。

LLM本质上只是一个语言推理系统,它虽然知道很多知识,但它没有"手"和"眼"。它不知道现在几点,也不知道今天广州下不下雨,更没法帮你操作数据库、执行代码或者控制设备。它只能"想",不能真正"行动"。

而工具本质上,就是把现实世界里的能力,包装成一种结构化接口(Schema),让模型知道:"这个东西能做什么、需要什么参数、会返回什么结果。" 以下是一个查询天气的例子:

复制代码
{
  "tool_name": "weather_api",
  "description": "查询城市天气",
  "parameters": {
    "city": "string"
  }
}

当Agent接收到"广州今天天气"这个任务时,它并不是直接回答,而是会进入一种循环:Thought(思考)→ Action(行动)→ Observation(观察),也就是昨天提到的ReAct框架。

一般的逻辑思考顺序是:

  1. 先思考需不需要工具

  2. 决定调用 weather_api

  3. 生成结构化JSON参数

  4. 系统真正去执行API

  5. 返回天气结果

  6. 模型再根据结果组织最终回答

这里可能会有个误区,以为"调用工具"是模型自己完成的,但实际上,模型只是负责生成调用指令,真正执行的是系统层。也就是说,模型负责"决定做什么",系统负责"真的去做",这个分层让系统层就可以加入很多容错机制。比如:

  • 参数格式校验

  • 超时限制

  • 自动重试

  • fallback备用方案

  • 默认参数补全

因为现实世界并不是稳定的,API可能挂掉,网络可能超时,返回的数据结构也可能变。如果没有这些系统层的保护,一个Agent在真实环境里会非常脆弱。这些机制是Agent的能够不偏离方向,能够完成任务的保证(至少会返回一个结果,会告诉用户到底做到了什么程度)。

另外,Agent其实是会"自我修复"的,比如模型第一次调用工具时,忘了传 city 参数,系统会返回:

复制代码
参数错误:缺少 city 字段

然后这个错误信息会再次进入上下文,变成Observation。模型看到后,会重新分析问题,然后自动补全参数,再调用一次工具,过程中产生的错误并不是流程终点,而是Agent下一轮思考的输入。这种模式就是我们之前说的模型会根据输出进一步调整直到最后有一个答案。

在Agent中,Memory决定Agent记得什么;RAG决定Agent能查到什么;而Tool Use决定Agent真正能做到什么。因为只有工具,才能真正把模型的推理能力连接到现实世界,就跟猿人第一次学会使用工具才能称之为人类一样。

相关推荐
魔术师Grace4 小时前
Agent总出错,什么时候才该训练模型?
llm·agent·强化学习
神奇霸王龙6 小时前
Cursor 3 + Claude Opus 4.8 屠榜:5 编程基座 IDE 卡位
ide·人工智能·ai·aigc·agent·ai编程·ai写作
冬奇Lab8 小时前
Code Agent 解剖(12):Harness 设计之二——上下文工程
人工智能·开源·agent
阿里云云原生9 小时前
智能体构建与进化——Agent 开源开发者沙龙·上海站精彩回顾 & PPT 下载
agent
樊小肆10 小时前
DeepSeeker-Code源码导读11-统一注册表registry
人工智能·agent
AI探索派11 小时前
Agent Teams和Agent Swarm是什么?多Agent协作原理实战拆解
人工智能·架构·agent
后端小肥肠11 小时前
开营 10 天变现率 20%:我用一套 Skill,把小红书虚拟资料跑成了可复制流程
人工智能·aigc·agent
莪_幻尘11 小时前
手把手书写你的第一个 AI Agent:当 Skill 有了记忆、角色和主动性
前端·agent
plainGeekDev11 小时前
Agent Prompt 怎么写:三个真实案例讲透
agent·ai编程·claude
不是株12 小时前
Agent Memory 架构
人工智能·agent