Agent = LLM + Tools

同步至个人站点:Agent = LLM + Tools

Agent = LLM + Tools

最近,AI Agent 这个词非常火。

比如 Claude Code CLI、Codex,它能像个程序员一样,在你的命令行里读写文件、执行代码。很多人觉得很神奇,它到底是怎么做到的?

今天,我想谈谈我的理解。一句话就能概括。

核心公式

我的观点是,AI Agent 的核心,就是下面这个公式:

Agent = LLM + Tools

Agent(智能体),等于 LLM(大语言模型),加上 Tools(工具)。

为什么这么说?我们来拆解一下。

LLM:思考的大脑

LLM,比如 GPT-5 或 Claude 4.5,是 Agent 的"大脑"。

它非常聪明,擅长阅读、理解、思考、推理和做决策。你给它一个复杂的目标,它能帮你拆解成一步步的计划。

但是,LLM 本身有一个巨大的限制:它是一个封闭的"黑盒"

它无法感知外部世界。你问它"我的桌面上有什么文件?",它不知道。你让它"帮我把 A 文件的内容复制到 B 文件",它也做不到。

它只能"想",不能"做"。

Tools:连接世界的手脚

要让 LLM "做"起来,就需要 Tools(工具)。

Tools,就是 Agent 的"手脚"和"感官"。它们是 LLM 连接外部世界的桥梁。

LLM 决定"做什么"(比如"读取 A 文件"),它不自己去读,而是去"调用"一个叫 Read Tool 的工具。这个工具负责真正执行操作,然后把结果(文件内容)返回给 LLM。

所以,常见的工具可能包括:

  • Read Tool:读取文件或网页内容。
  • Edit Tool:修改或写入文件。
  • Delete Tool:删除文件。
  • Find Tool:搜索信息。
  • Execute Tool:执行一段代码或命令。

LLM 负责决策,Tools 负责执行。两者结合,Agent 就能感知和操作外部世界了。

关键抽象:宿主环境

Tools 到底是什么?

我们可以再抽象一点:Tools 是"宿主环境"能力的封装。

这句话是关键。

  1. 在 Claude Code CLI 这个例子里,"宿主环境"就是你的操作系统 (OS) 。 Tools 封装的就是 shell 命令(比如 ls, cat, sed),让 LLM 能够操作你的本地文件。

  2. 如果我们想做一个"浏览器 Agent"呢? "宿主环境"就是浏览器。 我们就需要封装浏览器提供的能力作为 Tools。

Agent 的本质

所以,Agent 的创造逻辑就清晰了:

理论上,任何一个宿主环境,只要它提供的能力可以被封装成 Tools,我们就能基于它创造 Agent。

  • 宿主环境是 OS,Agent 就是 OS 助手。
  • 宿主环境是浏览器,Agent 就是浏览器助手。
  • 宿主环境是数据库,Tools 就是 SQL 执行器,Agent 就是数据分析师。
  • 宿主环境是 API 服务(比如天气、股票),Agent 就是你的生活助理。

不可或缺的"脚手架"

当然,一个真正好用的 Agent,光有 LLM + Tools 还不够。

它还需要很多"脚手架"来支撑运转,比如:

  • 上下文管理 (Context Management):LLM 的"记忆"有限(即上下文窗口),如何只把最关键的信息喂给它?
  • 记忆 (Memory):如何让 Agent 拥有短期记忆和长期记忆,从过去的经验中学习?
  • 执行机制 (Execution Mechanism):如何设计一个循环(Loop),让"思考"和"行动"能交替往复、持续运行?(比如 ReAct 框架)
  • 提示词工程 (Prompt Engineering):如何写好 Prompt,让 LLM 知道自己的目标、角色和手头有哪些工具可用?

但万变不离其宗,这些机制都是为了让 LLM + Tools 这个核心公式更高效、更稳定地工作。

总结

Agent = LLM + Tools

这个简洁的公式,为我们定义了一种新的软件范式。它告诉我们,如何将 LLM 的"智能"与现实世界的"能力"结合起来,创造出能自主感知和操作的智能体。

(完)

相关推荐
武子康4 分钟前
Codex 后台任务结束了,为什么还不能直接接着用?
人工智能·llm·agent
DeepAgent1 小时前
AI Agent 入门指南(05):Agent 循环——观察、思考、行动
面试·agent
plainGeekDev1 小时前
棘轮原理与实战:让 Harness 越用越可靠
aigc·ai编程·claude
stereohomology2 小时前
智谱的工程师是如何笃定认为这个不会被发现?
llm·薅羊毛·反被·羊毛薅
liulilittle2 小时前
mock 规范总纲
ai·自动化·llm·mock·测试·tools
VIP_CQCRE3 小时前
把 Coze 接入 Ace Data Cloud:用 OpenAI Responses 协议快速扩展你的 AI Agent 模型能力
ai·大模型·agent·coze·acedatacloud
是Dream呀3 小时前
Harness 工程:让 Agent 真正把任务做完
人工智能·分布式·缓存·agent
音视频牛哥3 小时前
从 LLM、VLA、LLA、SLIM 到实时音视频感知底座:具身智能真正需要的不只是大模型
人工智能·llm·机器人视觉·slam·vla·多模态感知·机器人音视频
我是小邵4 小时前
长对话先收口:用“工作记忆 vs 长期记忆“管理 AI 上下文
人工智能·ai·llm·长期记忆·中间迷失·上下文收口
Web3&Basketball4 小时前
Agent外传审计实战:3类失准事故拦截脚本
python·大模型·agent·性能调优·推理优化