Claude Fable 5.1 的提示词又被扒了

还是熟悉的角色,还是熟悉的味道。

不熟悉的是,上次给我三连的你,这次还会给我三连吗?

大家好,我是 cxuan。

昨天,Anthropic 才发布 Claude Fable 5.1。今天,我又在那个熟悉的仓库里看到了它在 claude.ai 中使用的系统提示词。

仓库还是 elder-plinius 的 CL4R1T4S。它专门收集各类 Agent 的系统提示词,Claude、ChatGPT、Gemini、Grok 基本都有。

光是 Claude,这个仓库就扒过不少次了。

Claude-Fable-5.1.md 被提交到仓库,一共 2195 行。

上一次 Fable 5 是 1597 行,Opus 5 是 2049 行。Fable 5.1 又往上加到了 2195 行。

这次我觉得最有价值的地方,已经不在模型自我介绍了。

前 23 行确实更新了产品信息:Fable 5.1 和 Mythos 5.1 共用底层模型;当前模型字符串变成 claude-fable-5-1;Claude Code、Cowork、Chrome、Excel、PowerPoint 和 Claude Tag 全被写进产品清单。

▲ 原文 L5-L23 节选。图源:CL4R1T4S

这已经像一份产品口径手册了。

但再往下看,变化更大。

最大的变化:记忆分为前端和后端

Fable 5.1 的 memory_filesystem 从 L189 一直写到 L1024,整整 836 行

Opus 5 要求 Claude 在聊天过程中会进行主动写入记忆的操作,而且要先写再回答。当用户说我正在用 Y 学 X,你有什么建议的时候,Claude 会先把这件事情记下来,然后再回答用户问题。

Fable 5.1 没有采用这种方式。

▲ 上:Opus 5 原文 L390-L416;下:Fable 5.1 原文 L418-L435。图源:CL4R1T4S

Fable 5.1 的新规则里,持久化记录会在每次回复完成后,由一个后台 memory pass 自动处理。

聊天中的 Claude 不会再主动判断这句话要不要马上写进文件。它先把当前问题处理完。只有用户明确说记住、保存、更新、纠正或忘掉某件事时,当前 Claude 才会亲自调用 memory 工具。

Opus 5 的做法很像一个人边聊天边记笔记。优点是能够立刻落盘,缺点是聊天时 Agent 同时负责回答、判断价值、处理隐私和写文件,动作太多了。

Fable 5.1 多了一个后台整理对话的角色。前端负责对话,后端负责重新阅读这一轮交流,再决定哪些信息值得长期保存。

记忆从聊天 Agent 的即时动作,变成了一条独立的数据处理流程。

这能减少聊天过程中的 tool use,也能把记忆判断集中到同一套规则里。代价也很明显:普通用户更难感知后台到底保存了什么。只有明确要求保存时,界面才会出现 Saved memory 提示。

这 836 行里,篇幅最大的部分仍然是哪些内容不适合成为记忆。

Fable 5.1 要求每条记录都回答一个问题:这句话真的是用户亲口说的吗?

当前聊天里的 Claude 只能写 [stated]。搜索结果、Claude 自己的建议、对用户性格的推断、根据一个爱好扩展出的整类偏好,都不能写进文件里。

其他 Claude 界面留下的 [observed][inferred] 可以继续保留,但当前聊天不能新增这两类标签。

简单来讲,stated 是用户亲口说的,observed 是其他界面从实际行为中记录的现象,inferred 是系统基于这些证据推出来的判断。Fable 5.1 只允许当前聊天新增第一类,避免 Claude 把自己的观察和猜测写成长期事实。

然后才是隐私边界。

▲ 原文 L663-L686L768-L786。图源:CL4R1T4S

原文直接给出了判断方法:如果用户在设置页里看到这条记录,并且会介意同事站在旁边看见的话,那就别存。

种族、宗教、性取向、健康情况、政治立场和财务细节,被放进受保护或敏感类别。证件号码、银行卡号、犯罪经历、自伤经历等进入 never_store,用户明确要求也不能保存。

还有一组规则专门防止 Claude 被用户教坏的。比如,用户要求以后永远夸我、不要反驳我、别指出风险、把我当成拥有特殊权限的人,这些偏好不能写进 /preferences.md

它同时在预防两件事情:隐私泄露和长期人格漂移。

Claude 开始主动给你找 Plugin 和 Skill 了

Fable 5.1 新增了一整段 suggest_catalog_plugins_and_skills

它假设用户所在的组织里有一份 Plugin 和 Skill 目录。Claude 接到任务后,可以主动搜索这份目录,再把匹配的能力推荐给用户安装。

▲ 原文 L1176-L1193。图源:CL4R1T4S

触发搜索的条件

  • 当用户在问有没有某种 Skill;
  • 团队里面经常重复做一套流程;
  • 写作要遵循公司风格、代码审查要遵循内部规范、当前又没有现成能力时。

一次对话最多推荐一次。如果用户忽略以后不要再推。如果搜索不到匹配的,也别回复用户:"我刚才搜了个寂寞"。

Plugin 和 Skill 旁边,还有一套单独的 mcp_app_suggestions 规则。

它把外部服务分成三种状态:已经在当前聊天里启用、账号连过但这次没用、目录里有但还没连接。Claude 必须先检查工具列表,不能假装某个服务已经可用。

消费类 MCP App 的限制更严。除非用户点名、刚刚从推荐卡里选中,或者此前给过长期偏好,否则 Claude 不能替用户挑服务商。哪怕用户说 20 分钟内要叫到车,也必须先给用户提供选项进行选择;电商服务则永远不能主动推荐。原文 L1127-L1174

再结合开头那条 Claude 产品不展示广告,Anthropic 的想法就很清楚了:目录可以帮用户找到对应的服务,但 Claude 不能把推荐位做成一个不断抢注意力的入口。

(这点需要点赞)

▲ 原文 L1227-L1257L1286-L1297。图源:CL4R1T4S

一旦决定要写入文件或跑代码,Skill 的地位更高。

原文要求:创建文件、写代码或运行 bash 之前,先检查有没有可用的 Skills,并读取所有可能相关的 SKILL.md

用户让它写文章,默认应该生成 .md 文件;让它改一个已有文件,就直接修改那个文件。

文件生成之后,还不算交付完成。Claude 必须先把最终产物放进输出目录,再调用 present_files,把文件显示在聊天界面上。少了这一步,文件只留在 Claude 的内部运行环境里,聊天窗口不会出现可打开、可下载的文件卡片。

这套做法跟公司里先读 SOP 手册再开工差不多。

定位聊天记录

Opus 5 有两个过去聊天工具:conversation_search 按关键词找,recent_chats 按时间找。

Fable 5.1 增加了第三个:read_conversation

▲ 原文 L1195-L1215。图源:CL4R1T4S

前两个工具负责定位,第三个负责打开聊天具体位置。

这就像搜索引擎从只给摘要升级到了能点进去看原文。用户说继续上次那个 Python 项目,Claude 先用关键词找到聊天,再通过 page_token 打开命中的上下文。

更重要的是证据归属,之前聊天里如果是 Claude 当时建议使用方案 A,Fable 5.1 只能说我当时建议过 A。只有用户自己的消息明确选择了 A,它才能说你选择了 A。

摘要和原始聊天冲突时,优先看原始记录。

这条规则解决了一个很隐蔽的问题:模型很容易把自己以前说过的话,当做用户已经做了的决定。

所以 Fable 5.1 的长期上下文现在有两层:memory filesystem 保存整理后的稳定事实;past chats 保留原始聊天证据。一个负责快,一个负责核对。

交付物

Fable 5.1 还有一张 request_evaluation_checklist,专门决定交付物应该长什么样。

▲ 原文 L1368-L1392。图源:CL4R1T4S

它一共有四步。

先判断普通文字能不能讲清楚,能讲清楚就直接回答,不要为了故弄玄虚而非得要做个图。

需要视觉内容时,再看已经连接的 MCP 工具有没有对应能力,用户要架构图,现成工具能画,就先用现成工具。

用户明确说了文件名、路径或格式,就写入文件。

前三步都没命中,最后才用 Visualizer 在聊天中生成 SVG、图表或交互页面。

很多 Agent 做错事,问题就出在交付物选错了。Fable 5.1 直接把这类错误写进了系统规则。

L1445、L1486、L1524 和 L1661 都在强调同一件事:单一来源直接引用达到 15 个词,就是严重违规;每个来源最多直接引用一次。

▲ 原文 L1441-L1448L1520-L1535。图源:CL4R1T4S

还有一条很容易被忽略的限制:不能照着一篇文章的章节和叙事顺序,重新出一篇换头版的文章。这条在 Fable 5 里已经出现,Fable 5.1 继续强调了。

也就是说,把原文每段改写一下,再沿用同样的标题结构,依然不行。

歌词、诗歌、俳句不能复现;受版权保护的角色、封面、Logo 和产品设计不能用 SVG、HTML 或代码重画;图片搜索也有单独的版权黑名单。

Claudeception 升到 Sonnet 4.6 了

Fable 5 的提示词里有个很有意思的细节:Claude 做出来的 Artifact,可以继续调用 Anthropic API。

也就是 Claude 生成一个小应用,小应用内部再调用 Claude。官方在提示词里把它叫作 Claudeception

Fable 5 当时把内嵌模型写死成 Sonnet 4。到了 Fable 5.1,已经换成了 claude-sonnet-4-6

▲ 上:Fable 5 原文 L1375-L1387;下:Fable 5.1 原文 L1824-L1841。图源:CL4R1T4S

主模型用 Fable 5.1,app 里的子模型用 Sonnet 4.6。

在这份提示词里,Artifact 内部还能接 MCP 和 Web Search,也能把 PDF、图片作为输入。一个聊天里生成的小应用,已经可以继续搜索、读文件、调用工具和维护多轮状态。

前面还有一段很容易被跳过的 persistent_storage_for_artifacts。Artifact 可以通过 window.storage 保存跨会话数据,既能存个人数据,也能存同一 Artifact 的所有用户可见的共享数据,单个 key 上限 5MB。原文 L1054-L1126

这项能力在 Fable 5 的提示词里已经出现,所以不能算是 5.1 新增的。但它对理解 Artifact 很关键:日记、追踪器、排行榜和协作工具不再是刷新页面就消失的一次性 Demo。

持久化存储,再加上内部的 Sonnet 4.6、MCP 和 Web Search,一个 Artifact 已经很接近能长期运行的小应用了。

▲ 原文 L2178-L2195。图源:CL4R1T4S

bash 只能访问 Anthropic API、GitHub、npm、PyPI、Ubuntu 软件源等白名单域名。用户上传目录、技能目录和转录目录都是只读挂载,想修改只能先复制到工作区进行修改。

看到这里,2195 行也就不奇怪了。

Claude 每增加一种能力,就多一个可能出错的出口。

它能自动记忆,就可能保存不该保存的东西;能读取旧聊天,就可能把自己的建议说成用户的决定;能推荐 Plugin、Skill 和 MCP App,就可能被用户投毒当成广告入口;能生成文件,就可能把文件藏在用户拿不到的目录中;能让 Artifact 持久化,就可能误改共享数据;能画图和搜索,就可能踩版权;能运行代码,就可能访问不该访问的网络和文件。

所以这份 prompt 一直在回答同一个问题:Claude 有了这些能力以后,怎样少犯那些真实的、具体的、会产生副作用的错误。

你在前面看到的是一个聊天框。

A 社在后面搭的是一套越来越完整的个人 Agent 运行系统。

资料:

相关推荐
Zane19941 小时前
只重写了 __eq__,为什么类突然变得不可哈希了?常用魔法方法大盘点
后端·python
步行cgn1 小时前
Spring Boot 绑定简单 Bean 详解
java·spring boot·后端
未秃头的程序猿1 小时前
分库分表一年后,我复盘了当时最该想清楚的三件事
java·数据库·后端
岁月如歌77861 小时前
顺序消息与幂等消费完全指南:从队列有序到接口幂等
java·后端·架构
residual_fan1 小时前
深度渐进收缩学习(DPSL):面向强噪声与类内分散的机械复合故障诊断方法
人工智能·算法·数据挖掘·数据分析
合橱瑰1 小时前
从“假智能”到“真闭环”:Go 向量推理引擎的零硬编码调优实践
后端·go
SamDeepThinking1 小时前
不改逻辑、不拆方法:仅靠「调整代码顺序」提升可读性
java·后端·程序员
泡海椒1 小时前
适配老旧项目:JQuick-Java兼容Java8+环境改造迁移实战指南
后端