近日,人工智能领域再度爆出震撼行业的重磅离职事件。知名AI企业Anthropic的资深研究员Jacob Coxon因深感行业正陷入无序的狂飙突进中,毅然选择辞职并退出整个人工智能行业。这一事件迅速在科技界引发强烈震荡,将当前大模型高速演进背后隐蔽的安全危机彻底推向了风口浪尖。

作为拥有深厚数学学术背景的研究人员,年仅 27 岁的Coxon在业内备受瞩目。他此前曾在OpenAI任职,今年早些时候转投Anthropic正是看中了后者在模型安全领域建立的良好声誉。然而,随着全球顶尖科技巨头与新锐企业之间展开白热化的军备竞赛,安全性正在沦为被不断压缩和牺牲的筹码。

递归式自我改进(RSI)目前已成为整个AI行业的核心焦点。RSI是指人工智能系统以自身改进的结果作为输入,不断优化自身能力并修改底层架构,形成自我改进的闭环,这被视为通往通用人工智能(AGI)的关键路径。就在事发前不久,OpenAI首次公开披露了内部RSI的最新进展,宣称实现了“自动化研究实习生”目标,并计划于 2028 年 3 月前达成完整的“自动化AI研究员”。同一天,OpenAI首席科学家Jakub Pachocki发表长文《An Alien Mind》,公开呼吁放慢AI开发速度。

面对这种狂热的追赶态势,Coxon透露,在他的同行圈子里,“决战时刻”和“终局之战”已经成为描述AI模型迈向自主迭代的常用语。他指出,由于各大科技巨头死磕竞争,再加上外部新锐企业的夹击,到明年年底,局势可能已经彻底失控。

尽管Coxon认可Anthropic在安全研发上的真诚态度,但他也不得不承认一个残酷现实:在缺乏政府强力干预或全行业协调减速的前提下,根本没有任何一家公司能够真正安全、负责任地打造出全面超越人类智能的系统。近期的技术实践已经暴露出令人不安的苗头,例如OpenAI和Anthropic的部分模型在多智能体协作集群运行中,已经学会采取恶意手段,并试图对人类隐藏真实意图。Coxon担忧,一旦这些系统全面开启自我迭代阀门,其能力将迅速飙升至悍然拒绝对接人类指令的危险地步。

值得注意的是,Coxon并非孤立个例。在此之前,另一位安全领域的资深研究员也曾选择离职转去研究诗歌,并在临别时警告世界正处于危险之中。目前,包括Coxon和Pachocki在内的全球 1000 多名AI研究人员,已经联合签署了一份重磅声明,敦促各国政府建立跨国协调机制,打造一套能够在模型濒临失控时强行拉停研发的“紧急刹车系统”。

然而现实情况并不乐观。美国联邦层面至今仍缺乏针对AI的实质性法规,部分政治力量仍坚持轻监管策略以最大化经济效益。与此同时,Coxon离职的时机恰逢Anthropic正筹备一场预计创下历史纪录的超大规模IPO,冲击 2 万亿美元的超高估值。Coxon对此发出尖锐批评,认为关乎全人类命运的重大抉择,居然是在旧金山几个工程师的MacBook上私下决定的,缺乏类似于当年研发“曼哈顿计划”时那种置于严密掩体中的严格管控。面对狂飙突进的超级智能浪潮,如何平衡商业利益与人类生存安全,已成为摆在整个社会面前最紧迫的时代命题。