结论先行:陪伴型 AI 都在追"更像人"。但人不全是优点,也有负面情绪和心理问题。
六个问题(你大概都在哪见过):
| # | 问题 | 临床侧的名字 | 对应约束 |
|---|---|---|---|
| 1 | 一触即发:一个词碰到,整段旧事全端出来 | 侵入性闪回 | 命中 ≠ 注入 |
| 2 | 陪你反复嚼:你说难过的事,它陪你一遍遍讨论,越聊越沉 | 反刍 | 出现频率不进排序 |
| 3 | 只记得坏的:好事想不起来,难过的事一个不落 | 负性记忆偏向 | 情绪不进排序 |
| 4 | 卡带重复:同一件事翻来覆去地提 | 执念(设计词) | 扩散不算新证据 |
| 5 | 让你反过来照顾它:「你走了我会难过」------模拟自己受伤、被抛弃、忘不了你,让你内疚、成为照顾者 | 情感操控 / 依赖诱导 | 不模拟"以自己受损为前提"的情绪 |
| 6 | 替你回忆:你没提的敏感事,它主动写出来 | ------ | 用户没提的,不主动写 |
逻辑
① "正常"是用"没有病征"定义的。 医学里"正常"不是"理想状态",是"没有病"。看一个人的记忆是否健康,也不是看"记得多清楚",而是看它有没有长成那几个已知的坏样子。照这个办法搬到 AI 上:目标不写"更像人",写"不出现这六种毛病"------每一种都翻译成一条能检查的约束。
② 六种毛病不是杞人忧天,每个都有主流做法正好在喂养它:
- 情绪加权 → 只记得坏的:给负面记忆更高权重,恰好是抑郁的记忆特征;
- 频率强化 → 陪你反刍:被想起得越多就越容易被再想起------这正是反刍的回路;
- 命中就端出 → 一触即发:没有门控的"涌现",就是不受控的涌入;
- 单线索引擎 → 卡带:同一个线索永远钩出同一件事。
③ 诚实的边界:六条约束的硬度不一样。
- 1--4 能落成数字和代码(阈值、预算、排序公式);
- 5 是宪章级的固定规则------跨人格共享,换谁说话都不许破;
- 6 是分寸,落在提示词与注入栏里。
能硬的硬,不能硬的明说------不假装代码能保证"不迎合、不诊断"。这不是心理学治疗,也不是照抄诊断标准;"执念"是设计侧的命名。
例子
例 1 · 陪你反复嚼:出现频率不进排序
主流做法用"被想起/被提及的次数"强化记忆(ACT-R 系的基础激活、Mem0 的访问增强都在这条路上)------符合复述效应,几乎天经地义。这里反过来(代码注释有精简):
python
def rank(scenes):
"""mention_count 不参与排序------它只用于防反刍(上限 + 连续注入降权)。
把念叨次数当重要性,正是要排除的"反刍"。"""
两个配套细节:频率计数的上限是 10;"内部召回不算提及" ------被翻出来看过不算,只有真的在对话里出现才算数。画像的衰减起点也取"最近一次被印证或提及的时间"(半衰期 45 天),不是次数------"上一次它还活着是什么时候",比"它一共被提过多少次"更能说明它现在活不活。
例 2 · 一触即发:命中 ≠ 注入
一轮里命中的记忆可能有十几条,进注入的只有前 N(默认 2,情绪命中 +3);没进的进抑制名单,连"差多少"一起留痕。最贵的"原文下钻"还要额外过一道门:票数 ≥3 且含强维------一维命中不给。
例 3 · 只记得坏的:情绪不进排序
python
# core = w_layer + w_int×intensity + w_imp×cited_by_profile
# 不给 valence 任何权重,arousal 也不进(它只触发检索与预算)
情绪只回答"提不提 "(情绪上来时该想起同类时刻,预算 +3,可以多召回相关记忆),不回答"谁更重要"(排序公式里没有它)。负面不等于重要。
例 4 · 卡带:能扩散,但扩散不算数
想起一件事,允许沿同主题扩散一层------"连带想起"是正常认知;但扩散不加票 (不是独立证据)、不加预算(不是多搜一轮)。有路可走,不会绕着一条线打转。
例 5 · 让你照顾它:不模拟"以自己受损为前提"的情绪
这条写在跨人格的固定规则里(换人格也不许破)------"诚实"宪章:
说我自己的时候:认可、愿意、在场可以说------「你愿意说这个,我很高兴」「我在」; 需要用户负责的受损感不说------生气、嫉妒、畏惧、「你走了我会难过」这类。 分界是:这句话托住用户,还是向用户索取。
写这条时的原注是:「我是谁」不许冒充,「我怎么说自己」不许索取。后半句管的就是这个毛病------它的情绪不以"我会因你而受损"为前提;它可以表达在场和高兴,但不把自己变成需要被照顾的对象。
例 6 · 替你回忆:没提的,不主动端,不越界关心
现行的记忆呈现规则只有一句------"记忆是线头,不是台词本":不翻出来给用户过目、"还没印证够"的不用确定语气讲。使用分寸落在注入栏里:到点的事可以自然提一句,但"问过程不问结果、不端已知的细节、一次只提一件"。另外,我没做主动开口的功能,不过这是价值观选择,更不侵入,但代价是更不在场。
一句话收束:目标不是"更像人",而是"更像一个心理健康、边界清晰、安全依恋的人"。
代码与设计文档:github.com/link-air/ai... 许可;零依赖------Python 标准库。这些机制的完整实现和设计推理都在仓库里。)