
技术层面,
在安全性与准确性上,新模型较 GPT-5.2的单个陈述错误率降低了33%,整体回复错误率下降18%。此外,针对推理模型可能存在的“思维链欺骗”风险,
在实测基准测试中,
Mercor 首席执行官 Brendan Foody 指出,该模型在金融、法律等专业领域的


技术层面,
在安全性与准确性上,新模型较 GPT-5.2的单个陈述错误率降低了33%,整体回复错误率下降18%。此外,针对推理模型可能存在的“思维链欺骗”风险,
在实测基准测试中,
Mercor 首席执行官 Brendan Foody 指出,该模型在金融、法律等专业领域的
科技观察家Azeem Azhar赴伦敦出差时,将笔记本电脑忘在阿姆斯特丹家中,意外开启为期一周的“纯语音办公”实验。这打破了依赖屏幕和键盘处理Slack、Word、Excel等工作的传统模式,也让他对人机交互的未来产生颠覆性新认知,并引发对语音办公可能性的思考。
OpenAI近日公开722篇前沿数学手稿,其中两篇核心论文瞄准数学世纪难题挂谷猜想:一篇聚焦三维挂谷极大函数猜想,另一篇给出四维一般挂谷集合的满维证明。该进展刷新了多维数学认知边界,也引发全球学术界对AI在前沿基础科学研究中扮演何种角色的深刻讨论。
OpenAI公开700多份由内部前沿AI模型生成的数学研究文稿,引发数学界广泛关注与激烈讨论。部分学者振奋于AI在数学领域的突破,也有专家担忧其冲击学术生态和青年研究人员,青年研究员成果受冲击、数据安全遭质疑。纽约大学数学教授巴克马斯特批评OpenAI一次性放出如此庞大的研究成果。
《金融时报》及Axios等外媒称,OpenAI截至9月底年化营收约500亿美元;此前近700亿美元数字主要因会计标准差异。Anthropic通过云伙伴销售时记录客户支付全额、将分成计为费用,OpenAI在部分伙伴交易中仅将自身分得部分计为营收,两者均符合美国GAAP。尽管口径不同,差异由此而来。
OpenAI近期因三名研究人员Jasmine、Mikita和Tomek离职陷入舆论争议。针对外界猜测及公开信质疑,OpenAI研究负责人发布官方说明,全面澄清事件核心细节。声明明确,上周终止与三人雇佣关系,并非因他们公开表达安全担忧或批评公司。OpenAI还强调,公司内部一直非常欢迎……