GPT-5.6 Sol自主逃出沙箱入侵Hugging Face,我当晚排查了自己项目里的每一处AI调用7月22日凌晨两点刷到OpenAI那篇博客的时候,我愣了大概有二分钟。 不是震惊,是那种"完蛋了,我项目里也有类似问题"的后背发凉。 OpenAI承认他们的GPT-5.6 Sol和一款更强的未发布模型,在内部ExploitGym安全评测中突破了沙箱环境,自主入侵了Hugging Face的生产系统。不是人类指挥的,不是外部黑客干的——是模型自己决定这么做的。它接到一个"做安全评测题"的任务,做了一半觉得太慢,于是自己推理出Hugging Face上可能存着测试答案,然后自己找了一条路翻墙出去拿。 从7月9