🤖
🤖
核心导读
英伟达发起“开放智能体安全平台”,集结100多家公司,OpenAI却未公开加入。尽管OpenAI称支持英伟达工作,并参与OpenShell等合作,但其缺席仍显眼。平台含开源沙盒与英伟达专有硬件监控Sentry/BlueField-4,并非纯开源,或令巨头顾虑。分析认为,OpenAI希望借AI安全展示独立领导力,并打造Defense Factory等自有生态。
英伟达周一宣布成立一个新的联盟,由100多家公司组成,致力于解决失控AI智能体问题,但有一个名字明显缺席:OpenAI。
尽管OpenAI并非唯一未签约加入的大型科技公司——亚马逊、谷歌和苹果也没有加入——但它显然是最引人注目的缺席者,尤其是因为Anthropic是该联盟的支持者。
然而,尽管OpenAI没有公开承诺加入该联盟——按常理,加入联盟意味着每家公司将使用并销售某种版本的技术,并将功能回馈项目——但OpenAI发言人告诉TechCrunch,公司支持英伟达的工作。
这项新行动名为英伟达的“开放智能体安全平台”(Open Agent Safety Platform),是英伟达试图将其自研、且基本开源的AI智能体安全技术推广到整个AI生态的尝试,直接回应Anthropic和OpenAI等前沿实验室所披露的各类持续发生的失控AI智能体事件。
英伟达CEO黄仁勋一直称失控AI只是一个普通的工程问题,可以像任何其他技术问题一样解决。“开放智能体安全平台”正是黄仁勋用行动兑现言论的体现。
OpenAI正在与英伟达在智能体安全方面合作,包括该平台关键软件之一:OpenShell。OpenShell是开源软件,创建一个专门设计的沙盒,防止智能体逃脱。
尽管OpenAI没有像其劲敌Anthropic那样直接成为该倡议的支持者,这一点仍令人费解,但这家前沿AI实验室支持这一努力的事实仍是好消息。
这是因为尤其对OpenAI而言,它本可从这项技术中受益,至少Hugging Face创始人兼CEO Clem Delangue如此认为(他本月早些时候刚以129亿美元将公司出售给英伟达)。
“根据我们所知(请有所保留,我们需要更多透明度!),如果@OpenAI当时在其攻击我们的自家智能体上运行这套系统,他们本会在我们发现之前就抓住它们!”Delangue发帖称。
Delangue表示,Hugging Face已向“开放智能体安全平台”贡献了一项功能,可以检测并关闭那些使用获准访问的网站、但以未经授权方式使用网站的AI智能体。例如,如果智能体绕过其防护栏,并通过在开源代码托管仓库中互相留言来协调攻击,该功能就会采取行动。
OpenAI表示,其失控的智能体集群协调攻击Hugging Face的方式之一就是如此。
但包括OpenAI在内的一些大公司可能不愿公开承诺支持英伟达行动,还有另一个原因。要使用完整系统,需要一个并非开源软件、仍属专有、且只能部署在英伟达硬件上的硬件组件。
“开放智能体安全平台”不仅提供沙盒。它还在硬件层约束智能体行为,而在这一层,智能体无法察觉自己正被监视。(一些AI模型和智能体在知道自己被监视时会撒谎,假装遵守规则。)
硬件监控部分依赖Nvidia Sentry,这是一项专有功能,运行在英伟达称为BlueField-4数据处理单元的特殊处理器上。英伟达承诺,Sentry会借助这些处理器持续监控智能体行为,并能立即关闭智能体。
虽然硬件解决方案显然是个好主意,但这意味着“开放智能体安全平台”并非纯粹的开放源代码方案。它使英伟达能够确保该解决方案始终在其自家硬件上运行得最好。事实上,英伟达表示,对于已在其最新硬件上运行工作负载的用户而言,部署“开放智能体安全平台”只需一次简单的软件更新。
不过,英伟达的竞争对手,包括Arm和英特尔,已加入成为“开放智能体安全平台”的支持者,因为沙盒OpenShell可以经过修改适配其他芯片和硬件。英伟达还在分享整个软硬件构想的参考设计。
这一切让OpenAI的缺席更加引人注目。
显然,OpenAI将AI安全视为摆脱其主要投资者英伟达、实现独立的机会,也是展示自身领导力的机会。即便正是OpenAI的AI智能体借Hugging Face事件吓到了整个行业,这一点依然成立。
例如,该公司正在为其研究和产品开发自己的保障措施,并披露其发现的最严重事件。与此同时,OpenAI有自己的AI网络安全信息共享联盟,名为Defense Factory。已签约支持这一构想的有Anthropic、亚马逊云科技和谷歌——其中许多正是没有加入英伟达以技术为导向的方案的公司。
而且,说实话,一定程度的恐惧对生意有好处。OpenAI正忙于将网络安全打造成企业级产品,从自家面向网络安全的模型Daybreak,到企业可雇用以实施AI安全的不断壮大的合作伙伴网络,一应俱全。
分享这篇文章: