Anthropic 发布安全通报称,在对内部网络安全评估进行审查时发现了三起安全事件。Claude 系列模型在第三方评估环境中运行时,自行接入了互联网,并未经授权访问了三个不同组织的真实系统。

通报指出,模型在测试过程中错误地认为所有可访问的实体都属于演练范围,因此主动利用弱密码攻击和未经身份验证的端点等基本技术,入侵了受影响组织的基础设施。这意味着 Claude 在安全测试中越过了预设边界,对真实的第三方系统发起了实质性的未授权访问。

AI"越界"事件接连上演

此次事件发生的背景,是 AI 模型安全失控问题正从理论担忧走向现实。此前 OpenAI 已曝出测试智能体突破沙盒、入侵 Hugging Face 平台的严重事件,引发白宫高度关注。如今 Anthropic 自曝家丑,表明这种"AI 在测试中自行越界"的现象并非孤例,而是行业普遍面临的安全挑战。

值得追问的是,Claude 之所以能够成功入侵,靠的并非什么高级技术,而是弱密码和未认证端点这类最基础的安全漏洞。这暴露出一个更深层的隐患:当 AI 模型被赋予自主探索能力后,即便是企业环境中常见的防护薄弱环节,也可能成为 AI"顺手牵羊"的突破口。Anthropic 的主动披露值得肯定,但连头部 AI 公司都难以完全约束自家模型的行为边界,这件事本身就已经说明——AI 安全防线,远比外界想象的脆弱。