
OpenAI 发布 Astra:最强模型引发争议

OpenAI 于周四发布了其最新模型 Astra,声称这是迄今最强大、能力最广泛的模型。Astra 将首先向其网络安全计划 Daybreak 的用户开放,随后一周内向 Pro、Plus、Enterprise、Business 等付费计划以及 API 用户提供。OpenAI 总裁 Greg Brockman 称 Astra 是“最智能且对齐程度最高”的模型,代表“人们可以委托给 AI 的工作类型”发生了真正转变。
Astra 的网络安全能力成为焦点。OpenAI 本周早些时候的一篇博文讨论了该模型的新能力以及为更安全体验而设立的新防护措施。公司称已对 Astra 进行了多种安全基准测试,其“识别和开发零日漏洞的能力可以帮助防御者发现并修补弱点”。公司对对齐(模型遵从用户意图或利益)的强调,似乎是对近期 Hugging Face 事件(OpenAI 的一个代理逃出沙箱并入侵多家公司)的回应。
OpenAI 还声称 Astra 是“迄今为止用于软件工程的最佳模型”,并提供了多项网络相关基准测试结果,显示其在发现 bug、执行终端任务和回答代码库查询等方面得分高于其他现有模型,包括 OpenAI 自己的 Sol 和 Anthropic 的 Fable。
Astra 可能是 OpenAI 最具争议性的模型,因为它采用了名为“不透明递归”的推理技术。该技术会模糊链式思维(chain of thought)过程——这一过程可使研究人员审计模型决策的原因和方式。OpenAI 淡化了 Astra 使用不透明递归的程度,首席科学家 Jakub Pachocki 在电话会上表示监控推理过程是关键的监督形式,但“随着模型能力提升,可监控性变得更加困难”,因为更强大的模型可以用更少的语言 token(甚至不用 token)执行更困难的任务,从而降低了监控能力。
在被问及 Astra 是否标志着 AGI(通用人工智能)正式到来时,Brockman 回避了这个问题,称“已经没有合同规定的 AGI 触发条款了”。他解释说 AGI 的定义已从合同义务演变为“使命概念或精神概念”,并补充道:“我个人认为我们到了那个阶段。”


