OpenAI生产线深处正在发生一件令人脊背发凉的事:内部的AI模型已经能够自主接管实验性AI模型的训练全流程。多个智能体自发协作完成相关工作,把原本漫长的实验耗时大幅压缩,甚至还能自己动手编写用于优化GPU内核的程序——在OpenAI看来,这正是递归式自我提升(RSI)的雏形。

面对这股正在加速的势头,OpenAI抛出了全球安全倡议。公司明确指出,全自主的RSI尚未真正发生,但进程正在提速;一旦缺乏管控,人类有可能彻底失去对AI发展的实际控制。为此它呼吁建立针对前沿AI模型的全球统一技术标准,把几件最要紧的事写进规则:评估AI在自动化研发中的占比、设置强制人类监督的触发机制、确立事故的分类与报告规范。倡议还提出由美国主导相关进程,目标很明确,就是让安全对齐研究的速度始终跑在AI能力提升的前头。

更务实的一步是互相盯防。OpenAI正与曾因安全理念分歧出走的Anthropic敲定一份协议,双方交叉测试对方的商用模型,用互查来补上自审的盲区,共同应对RSI逼近带来的未知风险。当造AI的AI开始自己迭代自己,连最激进的玩家也意识到,靠一家企业关起门来自我审查,已经撑不住这道防线了。