蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高风险场景优势突出,能在内容输出前实施毫秒级阻断。
目前 SingProbe 已适配29个主流大模型,是首个由大型科技企业开源的完整内生式安全技术解决方案,其开源代码和预训练模型已同步发布。

蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高风险场景优势突出,能在内容输出前实施毫秒级阻断。
目前 SingProbe 已适配29个主流大模型,是首个由大型科技企业开源的完整内生式安全技术解决方案,其开源代码和预训练模型已同步发布。
Andon Labs的Vending-Bench2测试中,AI以500美元模拟经营售货机一年。GPT-6 Astra平均账户余额达15515美元首次登顶,最差一轮也超过Claude Fable5.1最佳表现。差距不仅在于盈利,更在策略:Astra持续压低采购价,一度砍至原价约48%。
开发者pdfu发现,苹果在iOS 27和macOS Golden Gate私有框架中,将新版Siri AI架构设计为可与第三方模型深度协作。演示中Anthropic Claude、OpenAI GPT-5.6均可接入Siri。其“模型委托”机制让Claude以扩展形式出现,补足Siri不擅长的任务,与内置ChatGPT等协同工作。
英伟达CEO黄仁勋在洛杉矶All-In峰会与美国总统特朗普现场通话,双方就AI发展速度及数据中心建设争议展开讨论,通话经扬声器向现场观众公开。此前Anthropic CEO阿莫迪曾呼吁放慢人工智能发展,凸显业界对AI推进节奏存在分歧。
开发者深挖 iOS 27 与 macOS Golden Gate 底层代码发现,新版 Siri 私有框架已呈开放形态,可深度协作第三方模型。演示显示 Claude、GPT-5.6 均能接入 Siri;核心“模型委托”机制让 Claude 以 Siri 扩展形式运行,类似现有 ChatGPT 扩展,macOS 用户可调出搜索或询问。
Claude Opus 5.2 已悄悄在 Claude Code 灰度上线。开发者发现前端仍显示 Opus 5,但表现远超网页版;抓包显示背后模型 slug 已指向 Opus 5.2。这是大厂通过路由“障眼法”灰度测试新模型的常见做法。