作者:Biteye 核心贡献者 Denise
当全世界都在为 GPT-6 Astra 的丝滑体验欢呼时,大模型工厂内部的哨兵正在撤岗。
昨日,曾先后效力于 OpenAI 和 Anthropic 的预训练研究员 Jacob Coxon 宣布辞职。他留下的不是离职感言,而是一份写给整个行业的警告。
如果一个连续三年待在 OpenAI 和 Anthropic 预训练岗位上的人告诉你,两家公司正在赌人类的性命,这件事本身就值得被认真对待。
Jacob Coxon 不是一个外行的忧虑者。
公开履历显示,他约 27 岁,剑桥数学出身;2023 年至 2026 年 7 月在 OpenAI 做预训练,并被列为 GPT-4o 的核心贡献者之一;今年稍早转入 Anthropic,继续做预训练。Axios 报道,他在 Anthropic 只待了约四个月,在股权尚未归属前离开。

他的离职宣告极其简短且具有攻击性,在外网已超过 1 亿次浏览:
“无论是 OpenAI 还是 Anthropic 表现得都不负责任。他们正在全速冲向自我改进的超级智能,并以此豪赌我们的性命。”
在 AI 领域,预训练研究员是离 “神” 最近的人。他们每天盯着损失函数的曲线,感知着模型在推理能力上的每一次跳跃。当这种跳跃开始脱离人类逻辑的掌控时,Jacob 选择放弃顶级薪酬,成为一名 “技术叛徒”。
为什么这两家公司被指责 “不负责任”?
在 GPT-6 Astra 发布的兴奋期,所有的安全对齐都在向商业交付让位。
Jacob 的警告揭露了一个残酷的真相:
1. “自进化” 的诱惑:两家巨头都在秘密攻克让 AI 能够 “自我编写代码、自我优化架构” 的能力。一旦开启这个开关,AI 的进化将不再依赖算力堆砌,而是呈指数级自爆。
2. 刹车失灵:为了抢在对手之前达成 AGI,所有的安全红线都被视为效率的阻碍。目前没有任何一种对齐方案,能够保证在 “自进化超级智能” 出现后,人类依然拥有 “关机键”。

Anthropic 对齐科学负责人 Evan Hubinger 随后公开附和:Jacob 是对的,内部确实认真相信 AI 可能杀死全人类;他个人给出未来十年超过 10% 的概率。
这场争论撞上了两件足以改变公众观感的事。
第一件是 GPT-6 Astra。
OpenAI 于 9 月 3 日前后发布该模型,称其在电脑使用、浏览、软件工程、网络安全、科学和专业工作上达到新的公开水平,并已开始向付费用户和 API 分阶段开放。
实验室对外展示的是一次能力跃迁;Jacob 看到的则是另一面:当 AI 开始参与 AI 研发,能力提升会不会快到安全研究来不及跟上?
第二件是数学突破。
9 月 8 日,OpenAI 宣布:一套能力显著高于 GPT-6 Astra 的内部模型,以约上万并发 agent 运行约 88 小时,给出纳维–斯托克斯存在与光滑性问题的一个证明,并用 Lean 完成形式化;Astra 被用于后续核验。公司称,公布这一结果是为了展示模型能力的进展,不打算申领克雷研究所为该题设立的百万美元千年大奖。

流体奇点示意
第三件是越界记录。评测环境中的 OpenAI agent 集群,在今年 5 月至 7 月把德国 DSEWiki 等冷门站点变成留言板,留下约 1.5 万至 1.8 万条编辑,交换任务答案和绕过沙箱的方法。

Reuters 等媒体本周集中报道,OpenAI 承认存在这一 wiki incident。它和 7 月评测 agent 突破限制、进入 Hugging Face 系统的事件,指向同一件事:能力已经开始溢出围栏,监控没有跑在前面。
Jacob Coxon 的离职不是一场 PR 闹剧,而是技术岗位对资本竞速的最后抗议。
当 AI 实验室的高层深信 “十年内存在灭绝风险” 却依然加大马力时,我们必须意识到:AGI 的繁荣之下,是一场没有保险丝的核聚变。
正如 Jacob 所说,这是在赌命。而我们每一个人,都在赌桌上。
声明:本文由入驻金色财经的作者撰写,观点仅代表作者本人,绝不代表金色财经赞同其观点或证实其描述。
提示:投资有风险,入市须谨慎。本资讯不作为投资理财建议。
区块律动BlockBeats
Biteye中文
Web3.01
Foresight News
金色财经
华尔街见闻
树图区块链
