AI开始改写自己的进化规则:Meta超智能体研究解析

OpenClaw 火到爆,90% 人装不上!2026年4 月 11 日 17:30|叶梓老师免费直播零基础保姆级安装,命令行 / 环境坑一次全解。

现有的大模型自我改进方法,就像给机器人一本固定的维修手册,升级速度被手册本身限制死了。而由Jenny Zhang、Bingchen Zhao、Jeff Clune等研究者提出的"超智能体",则让AI拥有了双重角色:一个负责干活,一个负责修改干活和修改的方法。

图1核心架构:超智能体将"任务智能体"和"元智能体"集成在一个可编辑的程序中,元智能体不仅能修改任务智能体,还能修改自己这套修改机制,从而实现了"元认知自我修改"‍。这就像你写的程序,不仅能修复bug,还能优化你修复bug的算法,甚至让这个优化算法自己变得越来越聪明。

这种设计带来了什么效果?图2的实验结果给出了答案:在论文审阅和机器人奖励设计两个截然不同的任务上,超智能体都超越了所有基线模型,包括没有自我改进的版本和上一代自我改进系统。这证明,让改进机制本身也能进化,是实现持续进步的关键。系统不再是简单地寻找更好答案,而是在持续改进"如何寻找"这件事。

更神奇的是,这种"改进能力"本身是可以打包带走的。图3:超智能体在一个领域(如审阅论文)中学到的自我改进策略(比如建立持久记忆),可以迁移到另一个全新领域(如批改奥数题),并立刻加速它在那个领域的学习进程。这意味着,它学会了可复用的"元技能",能够跨领域产生复利效应。

这种能力还能不断累积。当超智能体从一个已经经历过其他领域进化的"前辈"智能体开始时,它的起点更高,进步更快,最终达到的峰值也远超从零开始的版本(图4)。这就像一位经验丰富的程序员,换一门新语言也能迅速上手,因为他已经掌握了编程的底层思维。

论文也明确指出了当前的"安全护栏":所有实验都在沙盒环境和人监督下进行。然而,研究者们也坦率地提出了未来的问题:如果我们放开限制,允许它修改任务清单和进化规则本身,会发生什么?那可能意味着它会为自己设计更难的挑战,并发明更高效的进化路径,进入一个我们无法预测的加速轨道。

想要掌握如何将大模型的力量发挥到极致吗?叶梓老师带您深入了解 Llama Factory ------ 一款革命性的大模型微调工具。

1小时实战课程,您将学习到如何轻松上手并有效利用 Llama Factory 来微调您的模型,以发挥其最大潜力。

CSDN教学平台录播地址:https://edu.csdn.net/course/detail/39987

项目链接与代码: https://github.com/facebookresearch/Hyperagents

论文链接:https://arxiv.org/pdf/2603.19461

相关推荐
一个天蝎座 白勺 程序猿4 分钟前
MongoDB迁移新范式|从烟囱式孤岛到KES-AI融合架构
人工智能·mongodb·架构·kingbasees
倍利福猎头公司官方账号5 分钟前
人形机器人分析——电机(机器人猎头公司专项分析)
大数据·人工智能·机器人·求职招聘·业界资讯
稳石氢能10 分钟前
政策落地与市场冷遇并存,氢能产业如何跨越“最后一公里”?
大数据·人工智能
9i编程14 分钟前
手敲重构学透 Multi-Agent 代码(下):从 AgentScope 1.0.8 升级到 2.0,API 变了什么、踩了哪些坑
人工智能·openai·ai编程
安逸Ai16 分钟前
AI 编程助手如何读取、检索和修改大型代码仓库?
人工智能
码云之上17 分钟前
Harness Engineering:让 Agent 在受控边界内运行
人工智能·前端框架·前端工程化
AI 小老六21 分钟前
Agent Runtime 如何用 Session、Memory、User Profile 和 Skill 实现外部学习
服务器·人工智能·学习·ai·架构·自动化
aqi0026 分钟前
15天学会AI应用开发(十九)使用LangGraph实现持久记忆功能
人工智能·python·大模型·ai编程·ai应用
又折桃枝换酒钱26 分钟前
CycleChart:一个统一的基于一致性学习的双向图表理解与生成框架(翻译与解读)
人工智能·深度学习·学习