【Agent智能体2 | Agent的自主性程度】

声明:本篇博客是以吴恩达的【Agent智能体】教程为基础,并对其中的内容做了笔记整理以及个人收获的总结。

Agent的自主性程度

网上有很多关于"哪些词能真正代表智能体"这样的争论,吴恩达在课程中说到与其争论哪些词都够真正的代表智能体 ,不如承认智能体可以有不同程度的智能体性 。这也是Agentic这个词的由来,Agentic(智能体性)是形容词,而不是一个名词。

这个图展示了较低自主性 (Less autonomous)以及 较高自主性 (More autonomous)的对比

  • 较低自主性 (Less autonomous)
    • 上半部分展示的是一个线性且固定 的链式工作流:用户输入提示词 →\rightarrow→ LLM 生成网页搜索词 →\rightarrow→ 系统执行网页搜索 →\rightarrow→ 系统抓取网页内容 →\rightarrow→ LLM 根据抓取的内容撰写文章。
    • 这个流程中,LLM 就像流水线上的工人。程序的每一步都是被开发者事先硬编码规定好的,LLM 只能在特定的节点被动接收指令并执行固定任务。
  • 较高自主性 (More autonomous)
    • 下半部分展示的是一个更接近智能体(Agent)模式的工作流,赋予了 LLM 决策权和反思能力。
      • 自主选择工具(Tools):
        • 在第一步"搜索网页"时,LLM有一个工具箱 (包含了网页搜索、新闻搜索、arXiv学术论文搜索),LLM 可以自主决定调用哪个工具来获取最好的信息
        • 在第二步"抓取最佳来源"时,LLM 再次利用工具箱 (网页抓取、PDF转文本),自主评估并挑选出5个最相关的来源进行深度解析,而不是盲目抓取所有结果。
      • 自我反思与迭代(Reflection):
        • LLM 在写完初稿(Write essay draft)后,没有直接输出结果,而是增加了一个"反思并改进初稿(Reflect and improve draft)"的环节。LLM 会自我审视文章的质量,并进行修改润色,最终输出成品。
          总结:
  • 我们可以看到有些智能体的自主性较低,执行一些列的线性步骤,通常是由程序员预先设定好的
  • 有些更有自主性,可以信任大语言模型做更多决策,具体执行的步骤序列甚至由大语言摸型快定,而不是由程序员预先设定

总结

这个图从左到右代表了 AI 系统的自主能力从低到高的三个发展阶段:

  • 较低自主性 (Less autonomous)
    这个阶段的 AI 系统更像是传统的软件程序,缺乏真正的决策权。
    • 所有步骤预先设定 (All steps predetermined): 整个工作流程(Pipeline)是线性的、固定的,由开发者提前规划好。
    • 工具使用硬编码 (All tool use hard coded): 在哪个环节调用什么工具(比如搜索、翻译)是被人类写死在代码里的,AI 无法改变。
    • 自主性仅限文本生成 (Autonomy is in text generation): AI 在这里的唯一作用就是在流程的固定节点上,根据给定的上下文生成一段文本,它不负责流程的控制。
  • 半自主 (Semi-autonomous)
    这个阶段的 AI 开始拥有"大脑"的属性,具备一定的逻辑规划和调度能力。
    • 能做部分决策、选择工具 (Agent can make some decisions, choose tools): 面对一个任务,AI 可以自己思考并决定接下来该怎么做,比如判断当前需要搜索网页还是查询数据库。
    • 工具是预设的 (All tools predefined): 它的局限性在于,它只能在人类事先提供好的"工具箱"里进行选择,不能超出这个范围。
  • 高度自主 (Highly autonomous)
    这是目前 AI 智能体追求的高级形态,具备极强的独立解决未知问题的能力。
    • 自主做出大量决策 (Agent makes many decisions autonomously): 面对复杂、长期的目标,AI 能够自行拆解任务、制定多步计划、执行、反思纠错,并在遇到障碍时动态调整策略。
    • 能即时创建新工具 (Can create new tools on the fly): 这是最核心的区别。如果人类给的工具箱里没有合适的工具,高度自主的 AI 能够根据需求现场编写一段代码来创造一个新工具,并立刻使用它来解决当前的问题。

通过这篇文章,我们能够了解到自主性高的智能体是什么样的:调用工具、拆解任务、制定计划、反思纠错,甚至能创造新工具!了解了这些,我们以后在使用 AI 时,也不应仅仅把它当成一个单步的'问答盲盒',而应该尝试给它更多的空间,激发它更高的自主性

如果这篇文章对你有帮助,欢迎点赞、评论、关注、收藏。你们的支持是我前进的动力!

相关推荐
AI探索先锋1 分钟前
AMD 2nm 芯片炸裂、欧洲首家人形机器人独角兽诞生、AI Agent 互联标准打响:10 条信号看懂产业变局|今日科技 AI 机器人快讯
大数据·人工智能·深度学习·搜索引擎·机器人
ARM|X86+FPGA工业主板厂家8 分钟前
RK3588+FPGA+EtherCAT异构架构解析|工业场景如何同时保住AI算力与微秒级运动实时性
人工智能·fpga开发·架构
玖妍呐10 分钟前
2026实测|3款一键AI求职证件照生成工具,适配简历网申(无水印/免费)
人工智能
tedcloud12311 分钟前
OmniRoute怎么部署?开源AI模型路由平台Linux部署教程
linux·服务器·人工智能·开源·音视频
叩码以求索15 分钟前
浅谈:算法萌新如何高效刷题应对面试(一)
算法·面试·职场和发展
动物园猫22 分钟前
人体部位目标检测数据集:5类别、7,000张图像 | 目标检测
人工智能·目标检测·计算机视觉
sramdram40 分钟前
离线语音识别芯片_低功耗智能语音识别IC解决方案
人工智能·语音识别·语音识别芯片·离线语音识别芯片
小码哥哥42 分钟前
四大企业AI知识库技术架构深度对比:从设计哲学到实现差异
人工智能·架构
聚焦前沿1 小时前
涡街流量计用户如何判断厂家是否靠谱
大数据·人工智能
谙弆悕博士1 小时前
信息系统项目管理师教程(第4版)笔记——第 2 章 信息技术发展
笔记·职场和发展·软考高级·软考·高项·项目经理