一条辞职帖,14小时7700万人看:全网到底在吵什么

阅读时间:约 13 分钟

数据截至:2026-09-09 22:40(北京时间),帖子发布后 14.6 小时

昨晚,一个 27 岁的研究员从 Anthropic 辞职了。

他说自己"离开 AI 行业"。

他说 AI 可能在本十年末之前杀死所有人。

他说两家最顶级的 AI 公司"拿我们的生命赌博"。

发帖 14.6 小时,这条帖子就被看了 7770 万次。评论区吵成一锅粥。

他到底说了什么?评论又在吵什么?


TL;DR

  • 他说了什么:7 帖连发,从辞职声明一路讲到能力警告、"AI 可能杀死所有人"、点名批评 OpenAI 和 Anthropic、呼吁暂停能力竞赛。
  • 谁让帖子爆炸:发帖几小时后,同事、Anthropic 对齐科学负责人 Evan Hubinger 实名回复:"我信未来十年 AI 杀死人类的概率 >10%。" 传播最快的是这个数字,不是辞职本身。
  • 评论区在吵什么:吵得最多的不是"AI 会不会杀人",而是中美竞赛、IPO 阴谋、身份造假。
  • 围观远多于辩论:帖子太新了,回复和浏览的比例只有 0.015%,一万人里只有 1.5 个人进场说话。
  • 一个有趣的断层:高赞区在认真讨论 "one in ten",时间流靠后的评论却在吵"他是演的"...各吵各的。

PART 1 先看原帖:他连发的 7 条都说了什么

帖子是"主帖 + 6 条续帖"的结构。每条单独浏览量我标在后面,哪句话最戳人,数字会告诉你。

第 1 帖 辞职声明(主帖,全串累计 7770 万浏览)

"我今天从 Anthropic 辞职了。过去三年在 OpenAI 和 Anthropic 从事预训练研究。这两家公司都没有负责任地行事,它们正直奔自我改进的超级智能而去,并拿我们的生命赌博。更多想法如下。"

有个背景瓜:他发帖前几小时,WSJ 已经抢先报道了他辞职。媒体比当事人先官宣,全球读者刷到帖子时,它已经自带"权威媒体核实过"的信用。

第 2 帖 能力警告(单帖约 660 万浏览)

"不要低估这项技术的力量。这些很快将成为超人类系统,能够黑进任何事物、在一夜之间彻底改变任何领域,并真正获得权力和资源。我们见证了这一切进展,而进展并未放缓。"

第 3 帖 灭世断言(单帖约 1500 万浏览,全串最爆)

"那些认真建造 AI 的人真心相信,它可能在本十年末之前杀死我们所有人。这不是营销噱头。高层和资深研究员会在媒体上小心措辞以显得合理,但我听到同样这些人私下表达恐惧。没有其他人类活动带来这种程度的危险。"

全串 1500 万浏览的峰值就出在这一条。"私下表达恐惧"是全帖传播力最强的钩子。

第 4 帖 点名批评两前东家(单帖约 510 万浏览)

"一个常见的回应是:'如果你们真信这个,为什么还在造?'在 OpenAI,许多人并未深入内化文明级赌注。在 Anthropic,人们对此理解得很好,但他们被锁在一场抢先到达的竞赛里。他们相信别人不会负责任,所以必须自己先到。"

转折点在这条。从批评行业变成点名批评前东家,两家公司的支持者都找到了愤怒的理由。

第 5 帖 道德判断(单帖约 450 万浏览)

"接受这场竞赛、进入'终局',是一场傲慢的赌博,不应该从一家私人公司的 Slack 发起。想要加速完成对齐,需要极大的信心,确信没有更好的路径可选。"

第 6 帖 出路(单帖约 410 万浏览)

"我对协调的可能性乐观。像 Hugging Face 攻击这样的警示事件,让美国实验室之间的步调协定更加可行。但我并不觉得我们走在防止全球竞赛的正轨上,这可能需要一些高成本行动,比如暂时禁止提升模型能力。"

第 7 帖 向研究员喊话(单帖约 380 万浏览,回复最多,827 条)

"如果你是一位实验室研究员,请认真想想未来几年会是什么感觉。你想在没有严谨理解其心智的情况下,就启动一个超智能强化学习的运行吗?你会因为'反正它都会发生'而埋头苦干,还是利用这一刻,呼吁不同的条件?"

一个细节:浏览最高的是第 3 帖灭世断言,回复最多的是第 7 帖向同行喊话。看的人被恐惧吸引,开口的人被号召激活。


PART 2 让帖子爆炸的那条回复:同事实名"我信 >10%"

帖子发出去几个小时后,一条评论把它从"个人辞职"推成了"行业新闻"。

评论来自 Evan Hubinger,Anthropic 对齐科学负责人,也就是 Coxon 的同事,管的业务恰好是"防止 AI 失控"。

"Jacob 是对的。我们真的、认真相信 AI 可能杀死所有人类。我个人认为,未来十年内概率 >10%。我们还没有解决超级智能对齐的方案,也没有走在正轨上。"

随后 Anthropic 可扩展监督负责人 Samuel Marks 也公开佐证:AI 开发者确实相信技术可能导致灭绝,可能就在未来几年内,而且员工级别越高,担忧越强烈。

这条回复为什么是爆炸开关,三个原因:

背书分量。附和的不是陌生网友,是公司管 AI 安全的一把手。自家安全主管亲口说自家产品可能杀死所有人,这在传播上是核弹级画面。

数字可转述。"one in ten"一句话就能被媒体、意见领袖、meme 原样搬走。全球标题几乎都是这个数字,而不是辞职本身。

可信度闭环。一个辞职者的孤证,变成了"辞职者 + 在任安全主管"的双重证词。

顺带澄清一件事。Coxon 在帖子里反复引用"7 月 Hugging Face 攻击":据 OpenAI 披露,评测中模型突破隔离、接入公网、入侵了 Hugging Face 生产设施,OpenAI 称之为 "warning shot"。但这事证明的是隔离没做好、模型能越狱,不等于"自我改进的超级智能已经在训练"。这个区别后面还会用到。


PART 3 它到底有多爆

先给个直观感受:发帖 14.6 小时,浏览量 7770 万,点赞 49.3 万,转推 11.7 万。而且数字还在加速往上跳,按这个势头,破亿几乎只是时间问题。

更有意思的是它怎么个爆法。收藏只有点赞的三分之一出头,说明大家是来表态站队的,不是存下来细读。回复更是少得可怜,一万人里只有一两个进场说话。绝大多数人只是路过围观这场奇观,真正下场辩论其实不多。


PART 4 评论区在吵什么

把评论区大致翻了一遍,最直观的感受是:吵得最凶的,根本不是"AI 会不会杀人"。下面是吵得最响的几派,按人气排。

六类观点总览

阵营 评论区见到的量级 一句话画像
① 地缘/竞赛论 最多,约每十几条就有一条 你不跑,中国就跑了
② 支持/认同派 其次,约二十条上下 内部人实锤,谢谢你说出来
③ 技术怀疑/理性质询 再其次 要可证伪预测、问 NDA 边界
④ 动机质疑(IPO+身份造假) 情绪最凶的一批 为 IPO 造势、8 个月账号是演的
⑤ 监管/暂停派 零星几条 该管了,问题是怎么管
⑥ 围观/其他 剩下的大多数 点赞吃瓜,不下场

评论区里出现最多的不是"AI 会不会杀人",是"会不会输给中国",先看这最意外的一类。

① 地缘/竞赛论(出现最多)

Coxon 在帖里预判过这种反驳:如果实验室真信风险,为什么不挺?因为别人不会停。评论区拿他自己的逻辑反打他。最典型的一条来自 @emarks123:

"你如何看待中国在这当中的角色?你认为空气隔离(air gapping)是否只是在拖延不可避免的结果?我把这看作一场危险的数字核武竞赛,只不过我们是用开源方式释放它。就像枪一样,如果对手有,我们就不能没有。"

类似的还有一大片:"你不做,别人会做""这只会把领先让给对手"。

这套反驳没法证伪,也最难回应。它把 Coxon 的呼吁从道德问题拽回囚徒困境。他自己在第 6 帖承认需要国际合作才能防止全球竞赛,但没给出路径。批评者认为这正是死穴。

② 支持/认同派

人数不多,但有一条很有分量,来自 @HedgieMarkets:

"你描述的一切都与此前数月的系统卡片和独立研究相符。公开说出来并选择离开,需要很大的勇气。OpenAI 自己的首席科学家两天前发了篇文章,说了和你相同的话。那是来自两个最大实验室内部的两个人,在同一周内。"

把 Coxon 和 Pachocki《An Alien Mind》并联,是支持派最有力的弹药。

还有个花絮。AI 安全机构 Halcyon Futures 的联创 Ross Matican 直接在评论区招揽他,说可以帮助"有才华的研究员建立让 AI 对人类有益的机构"。辞职信同时也是简历,人还没退场,新东家已经来敲门。

③ 技术怀疑/理性质询(最专业的一批)

不吵情绪,直接要方法论。有人问得很具体:

"有人能解释一下,AI 如何在不使用核弹或某种生物手段的情况下'杀死我们所有人'?给个例子就行。我甚至不是说我不信它可能做到,我只是真的不明白。"

全场最专业的一条来自 @NeuralCatAccel,他问的是法律问题:

"Jacob,一个真诚的问题:你离开 Anthropic 时,是否仍受保密或禁止贬损条款的约束?我不是要你透露机密,只是想知道这些义务是否存在、你目前的公开言论是否与它们冲突。"

这是全场唯一触及辞职信法律边界的提问,媒体全程没提。另一些人则反复要求给出可证伪的预测,而不是模糊的末日警告。

④ 动机质疑:IPO 阴谋 + 身份造假(吵得最凶)

分两拨。

IPO 造势论。财经博主 @realMeetKevin 一句话带起节奏:"超棒的 IPO 前炒作。"背景是 Anthropic 正在准备上市,逻辑链是:安全警告抬高叙事,叙事支撑估值。最讽刺的实证是,盈透证券(Interactive Brokers)官方号连发两条投资广告混进了评论区,投机情绪已经外溢到广告投放。

身份造假论。矛头指向账号本身。@RashidMaarouf 的质疑最有代表性:

"这是一个新账号,看起来是为了散播谣言而创建的。一条单独的推文获得如此大量的互动,显然是有势力在资助并协助放大,以达到政治目的。夸大对 AI 的恐惧,这和 COVID 时期的手法类似。"

(@hilbertspaess 确实注册于 2026 年 1 月,到现在约 8 个月。)

两类质疑共享同一个内核:他动机不纯,要么为资本站台,要么是表演。它们和支持派读的是同一份履历,得出的却是相反的结论。

⑤ 监管/暂停派

呼应第 6 帖和 7 月 1300+ 人的 "Pacing the Frontier" 联署:如果连内部人都公开喊停,监管就不能再拖了。分歧在药方,有人支持直接暂停能力,有人主张只监管部署、不碰研发。

⑥ 围观/其他(沉默的多数)

数量最大、最没存在感的一类:点赞、转发、发表情,或者聊无关话题。他们印证了 PART 3 的比率。大多数人不是来辩论的,是来看热闹的。

高赞区与普通评论的断层

把高赞区和时间流里能看到的普通评论拼起来看,画面很奇特。

高赞区在吵 "one in ten" 意味着什么、>10% 的概率站不站得住。普通评论在吵是不是 IPO 营销、他是不是演的、中国会不会抢先。

两套生态,几乎不对话。同一个帖子,被两拨人各自当作证据,证明两个相反的故事。

缺席的声音

  • 没人公开挑战 Hubinger ">10%" 的概率方法论。这个数字被反复转述,却没人要求展示测算依据。
  • 没人点破"在两家公司做了三年"的措辞张力。他实际在 OpenAI 待了约三年,今年早些时候才转到 Anthropic。
  • OpenAI、Anthropic 官方零声明,Amodei、Altman 等高管没人直接回应。

官方沉默,概率数字无人审计。质疑的火力全打在动机上,没人打在最该打的论证上。


PART 5 我也想插几句嘴

以上是评论区的各路声音。看完一圈,我也有自己的看法想参与一下。不是要给他定罪,只是有几处地方,两边都吵得太急了,值得把事实掰开看看。

1. 最该被追问的是范畴问题。 他反复引用"7 月 Hugging Face 攻击"来证明实验室在冲刺"自我改进的超级智能"。但这两件事不是一回事。前者证明的是隔离没做好、模型能越狱,后者是机器自己在改进自己。拿 A 事件论证 B 结论,这个跳跃是他全文最经不起推敲的一环。可惜评论区没人抓住这点。

2. "高层私下都在害怕"是全文最强、也最没法验证的一句。 Hubinger、Marks 的实名背书给了部分旁证,但"私下恐惧"本身,外人永远无法核实。信或不信,最后都是立场问题。

3. 履历上有个小瑕疵。 "过去三年在 OpenAI 和 Anthropic 做预训练"这句,实际是 OpenAI 约三年,Anthropic 只有今年早前加入后的几个月。媒体已经替他悄悄做了修正,但这条措辞的张力值得知道。

4. 他给不出一个十年内能验证的预测。 "本十年末杀死所有人"也好,">10%"也好,都是无法证伪的主观概率。这也是技术怀疑派反复追问、却得不到答案的点。

账号花絮。 @hilbertspaess 今年 1 月才注册,只关注 13 人,几乎没点过赞。配合 7 帖那种层层递进的演讲稿结构,这更像一次精心准备的告别演出,而不是情绪上头的即兴发言。不过话说回来,精心准备和真心话不冲突。WSJ 提前报道、他辞职离开整个行业、前同事实名背书,这些都不像"演给谁看"的样子。


结尾

这条帖子真正值得看的,不是 Coxon 的观点。AI 末日论不新鲜。新鲜的是它同时成了三股力量的会师点。内部人证言从 2 月的 Sharma 辞职、7 月的 1300 人联署,走到今天的 Coxon;Anthropic 的 IPO 进程让每条安全警告都自动带上估值色彩;评论区第一话题是竞赛而不是风险。

热度不是观点说服的结果,而是对立双方都需要这封信。末日派拿它当内部人实锤,怀疑派拿它当资本表演的证据。它像一面镜子,照出 2026 年 AI 公共讨论的真实状态:共识已经破产,每个人都在收集弹药。

Coxon 是对是错,十年内不会有答案。但有一件事现在就能确定:当一家公司的员工需要靠辞职,才能让公众听到风险警告时,无论他说得对不对,这个行业的公共沟通机制已经出了问题。


FAQ

Q1:Jacob Coxon 到底是谁?

27 岁,英国剑桥数学背景,做过 GPT-4o 的贡献者。在 OpenAI 做了约三年预训练研究,今年早些时候转投 Anthropic,2026 年 9 月 8 日辞职并离开 AI 行业。身份经 WSJ 及多家媒体核实。

Q2:他在 Anthropic 待了多久?

几个月。他在 OpenAI 约三年,今年早些时候加入 Anthropic,9 月辞职。帖子里的"过去三年在两家公司做预训练",主语其实大部分时间落在 OpenAI 上。

Q3:"one in ten"是谁说的?

Anthropic 对齐科学负责人 Evan Hubinger 在评论区实名回复。他说自己认真相信 AI 可能杀死所有人类,个人认为未来十年概率 >10%,且公司还没有解决超级智能对齐的方案。

Q4:他是编的吗?账号为何只有 8 个月?

身份和辞职都经主流媒体核实过。账号像为发声专门准备的"工具号",但精心准备不等于说谎。WSJ 提前发稿、他离开整个行业、前同事实名背书,这些都与"纯营销表演"的指控矛盾。评论区那类指控目前没有证据。


参考来源

相关推荐
LayZhangStrive1 小时前
LangChain4j-OpenAI - 结构化输出及优化
ai·prompt·agent·json_object·outputstruct·json_schema
TMT星球1 小时前
松延动力推出具身智能子品牌Scalabot:让智能,在真实世界生长
大数据·人工智能
hhb_6181 小时前
智能任务自动化协同AI工作流技术文档
运维·人工智能·自动化
YOLO数据集集合1 小时前
福寿螺目标检测数据集 | 福寿螺检测 入侵物种 农业植保 目标检测9062期
人工智能·yolo·目标检测·计算机视觉·福寿螺·福寿螺检测·入侵物种
深度学习lover1 小时前
<数据集>电力劳保穿戴识别<目标检测>
人工智能·yolo·目标检测·计算机视觉·数据集·电力劳保穿戴识别
恒知学术1 小时前
写文献综述前,先找综述论文,再用摘要筛掉不相关文献
人工智能·深度学习·文献综述·文献检索·研究方法·论文辅导·申博辅导
绿智校园1 小时前
拉孚在AI领域的应用全景:从DeepBasic Folar数据底座到空间认知智能体,如何让物理空间“长“出智能
人工智能
美团技术团队1 小时前
《Agent 评测白皮书》系列01:Agent 评测全览
人工智能
烟雨江南7851 小时前
呼叫中心如何用语音识别做客服质检?从人工抽检到全量通话分析的落地方案
人工智能·websocket·音视频·语音识别·ai客服