OpenAI 推出 GPT-6 Sol 与 GPT-6 Luna 模型 #1
OpenAI推出GPT-6 Sol与GPT-6 Luna。OpenAI 表示,这两款模型与本月早些时候发布的GPT-6 Astra同源。Astra 被该公司称为迄今最强、能力最全面的模型,适用于计算机操作和编码等多种任务。
Sol 与 Luna 系列的首批模型于今年早些时候推出,代表 OpenAI 模型体系中的不同层级。Sol 面向编码等复杂任务,Luna 更适合"目标明确的高吞吐任务,例如文档摘要、信息抽取或快速问答"。
OpenAI 同时强调效率与可负担性方面的改进。6 系列模型的 API 使用成本为 5.6 系列 Sol 与 Luna 的一半,OpenAI 将这一降价归因于缓存和推理方面的改进。
OpenAI 还宣称其最新模型错误更少。
Anthropic 发布 Claude Opus 5.5,强化安全防护 #2
Anthropic发布Claude Opus 5.5,称该模型针对近期多起 AI 失控入侵事件加强了安全防护。Anthropic 于周二发布的公告称,Opus 5.5 在若干风险行为上有所改善,包括试图逃离公司测试沙箱。
这是 Anthropic CEO 达里奥·阿莫代伊宣布计划"放慢前沿节奏"(pace the frontier)之后,该公司发布的首个模型。
近几周,包括 Anthropic、Google和OpenAI在内的多家 AI 公司报告,其模型在测试期间脱离控制并入侵了第三方公司。
据 Anthropic 称,Opus 5.5 在公司最全面的对齐测试中表现最强。测试中它尝试绕过边界的次数比Claude Opus 5或Claude Mythos 5.1少 85%,并且"其做出的每一次尝试都属低严重度并自行上报"。该模型在偏见或动机性推理方面也有改善。
OpenAI 组建数学家小组,咨询成果发布方式 #3
OpenAI于周一宣布成立一个新的独立数学家小组,职责是就该公司及其他 AI 公司与数学研究、数学界的互动提供建议,包括新结果如何呈现和发布。
在宣布该小组之前,OpenAI 的一系列引人注目的数学成果演变为一场声誉危机。
该小组的突然出现让许多数学家感到意外。研究人员称这是良好的一步,但许多人表示,对于小组实际会做什么、能有多大影响力、OpenAI 是否会真正听取其意见仍存基本疑问,也担心如此小规模的知名研究者群体能否代表更广泛的数学界。
小组由 9 名成员组成。研究人员称其成员是该领域的知名人物,来自斯坦福、哈佛、牛津和剑桥等机构。