Jacob Coxon,前OpenAI和Anthropic预训练研究员,今天正式宣布辞职。
过去三年,他亲历了两家最顶尖AI公司的核心训练工作。
他的判断非常尖锐:这两家公司目前都没有在负责任地行动。它们正全速冲向“自我改进的超级智能”,本质上是在用全人类的生命做一场豪赌。
他说,真正危险的不是外界的炒作,而是内部人的真实态度。
构建这些系统的人,私下里真心相信AI有可能在这个十年结束前杀死所有人。
这不是公关话术,也不是营销恐吓。
很多高管和资深研究员在公开场合会把措辞说得更“理智”,但私底下表达的恐惧是一致的。
没有其他任何人类活动,能造成这种级别的文明级风险。
为什么他们明知道风险还继续做?
在OpenAI,很多人其实还没有真正把“文明存亡”内化到决策里; 在Anthropic,风险被充分理解,但他们陷入了典型的竞赛逻辑——“别人不会负责任,所以我们必须先到,即使风险巨大”。
他把这种状态称为进入“终局”(endgame)的自大赌博。
试图在私人公司的Slack里“速通对齐”,需要极高的信心去证明:没有更慢、更稳妥的路径可选。
而他并不觉得我们目前走在正确的轨道上。

