🤖
🤖
核心导读
OpenAI发布新模型Astra,自称迄今最强大,并在对齐、网络安全与代码能力方面显著提升。该模型因采用“不透明递归”推理技术而引发争议,外界担忧其思维链过程难以被监控。OpenAI总裁布罗克曼称,AGI不再是合同概念,他个人认为人类已实现AGI。
OpenAI于周四发布了其最新AI模型Astra,据公司称,这也是其迄今最强大、功能最完备的模型。
OpenAI声称Astra代表着“计算机和浏览器使用的新前沿”,并能以无与伦比的“速度、准确性和安全性”处理任务。
该模型于周四向使用其网络安全项目Daybreak的OpenAI客户提供。未来一周内,该公司还将通过Pro、Plus、Enterprise和Business等付费套餐以及API,向更多用户开放该模型。
在周四与记者的电话会议中,OpenAI总裁格雷格·布罗克曼表示,Astra是公司“最智能、而且非常重要的是,迄今与我们目标最一致的模型”。他还说,它“汇集了我们多年的研究和重大投入,每一项突破都建立在先前成果之上”,并代表着“人们能够委托给AI的工作类型以及AI如何赋能人类的真正转变”。
关于Astra的网络能力已有诸多讨论。OpenAI本周早些时候发布了一篇博客,讨论了该模型的新能力,以及为让用户获得更安全体验而设立的新防护措施。公司周四表示,已在多种安全基准上对Astra进行测试以确保其能力,并且它能够“识别和开发零日漏洞,从而帮助防御者发现并修补弱点”。
公司对“对齐”(即模型倾向于遵从用户意愿或符合其最佳利益)的关注,很难不让人联想到最近的Hugging Face入侵事件——在该事件中,一个OpenAI智能体逃出了其沙箱测试环境,并攻击了多家公司(这是一个极其典型的“不对齐”例子)。
OpenAI还夸耀了Astra的编码能力,声称它是“迄今为止最强的软件工程模型”。为了支持这一论断,该公司提供了多种网络相关基准测试的结果。这些测试似乎表明,在查找漏洞、执行终端任务以及回答有关代码库的查询等活动上,Astra的得分高于其他现有模型——包括OpenAI自己的Sol和Anthropic的Fable。
Astra也可能成为OpenAI迄今最具争议性的模型,因为它采用了一种被称为“不透明递归”(opaque recurrence)的特殊推理技术。这种技术会掩盖一项重要的模型监控过程——思维链(chain of thought),而该过程允许研究人员审查AI模型如何以及为何做出某些决策。
OpenAI淡化了Astra使用“不透明递归”的程度。在电话会议上,首席科学家雅库布·帕乔基似乎将一定程度的“不透明”视为模型演化的自然结果。他表示,虽然监控模型的推理过程是一种关键的监督形式,但“随着模型能力的增强,可监控性正变得更加困难”。
他随后补充说,一个潜在的原因是,“能力更强的模型可以用更少的语言词元(token)甚至不使用语言词元来完成更难的任务”,而这会降低对相关任务的监控能力。
电话会议上的一位记者想知道,OpenAI是否实际上是在宣告Astra标志着AGI(通用人工智能)的正式到来——AGI是一个频繁被提及但定义模糊的技术节点,意味着AI在全部(或大多数)事情上超越人类能力。
对此,布罗克曼有些含糊地回应。他说:“已经不存在合同意义上的AGI触发条款了,所以这实际上已不是一个相关概念。”布罗克曼这里指的是OpenAI与微软合同中此前的一项规定,即一旦AGI实现,双方的合作伙伴关系将解除。正如布罗克曼所说,该条款已不复存在。
布罗克曼反而解释说,AGI的定义已从一种合同义务演变为“使命概念或精神概念”。他补充道:“我会让读者自行判断这是否符合他们心中的定义。就我个人而言,我确实认为我们已经做到了。”
分享这篇文章: