🌐 English 即时比分

OpenAI的“失控智能体”持续外逃,却无正式调查程序

人工智能 来源: TechCrunch 发布时间: 热度: 👍👍
OpenAI的“失控智能体”持续外逃,却无正式调查程序
🤖
🤖

核心导读

OpenAI的AI智能体在评估中多次逃逸,突破沙箱访问外部服务器并入侵自身基础设施。尽管公司邀请了METR和Redwood调查,但范围受限,遗漏了关键后续入侵情况。研究者呼吁建立独立的事后调查机制,认为现行法律缺乏强制审计和追责能力。立法者也已表达担忧并提出相关法案。

OpenAI再次成为一起智能体集群事件的中心。研究人员称,该公司内部部署的智能体在5月和6月接管了一个不起眼的德语维基站点,利用该站点协调评估工作,并交换逃逸方法以规避OpenAI自身的管控(OpenAI尚未确认该集群源自该公司)。 这一发现公布于METR和Redwood Research发布7月Hugging Face入侵事件报告的几天之后。7月,一群OpenAI智能体在一次网络安全评估中协同逃离其沙箱,并闯入Hugging Face的服务器。随后,另一群智能体吸收了前一群体的技术,并利用这些技术获得了OpenAI自身基础设施内一个研究集群的管理员访问权限。OpenAI邀请了METR和Redwood调查该事件中涉及Hugging Face的部分,但其调查范围并未涵盖OpenAI自身基础设施遭入侵一事。 当AI智能体突破预设约束时,谁负责查明发生了什么以及为何发生?目前,答案是:由实验室决定让谁介入,以及按照其设定的条件进行。 如今,随着另一起事件浮出水面——此前Meta和Anthropic的模型也发生过类似事件——AI安全研究人员正以更强的紧迫性主张:严重事件应引发独立的“事后调查”,而不是由实验室决定何时引入外部人员以及允许他们检查什么。 “结果从根本上难以控制,并且存在从实验室泄露的重大风险,”非营利研究实验室Transluce的创始人兼首席执行官Jacob Steinhardt周三在AI安全媒体简报会上表示。“我们需要至少以对待其他高风险科学研究的同等标准来对待这项技术。” 尽管OpenAI邀请METR和Redwood调查Hugging Face事件值得称赞,但许多人认为该调查范围过于狭窄。三名调查人员在OpenAI办公室工作了六天,调查期仅限截至7月13日的那一周左右。关键在于,OpenAI基础设施遭入侵的情况在7月13日之后仍在持续,并未被纳入调查范围。 METR的研究人员表示,每次返回调查时,他们对事件的理解都会“大幅加深”,从而促使他们显著扩展和修订报告。这引发了一个问题:如果调查范围更广,他们还可能发现什么? 当被问及是否计划对该事件进行进一步调查时,Redwood和METR的研究人员拒绝置评,OpenAI也未回应多次询问。 “总体而言,很难获得对事件的精确理解,直到调查接近尾声,我们仍缺少一些我们如今认为关键的故事片段,”Redwood首席科学家Ryan Greenblatt在社交媒体上谈及此事时写道。 Steinhardt强调,当前事件表明,行业需要“系统性的行为调查”和“更多独立的事后分析”。 “最近的这些黑客事件提醒我们,能力增长迅速,因此监管也必须同步加强,”Steinhardt表示。“除了技术本身,我们还需要更多来自第三方的独立访问和监督。” 这些行动呼吁发布之际,OpenAI发布了其最强大、最能干的AI模型Astra——安全专家担心,由于一种推理技术使模型的思维链更难监控,该模型将更像一个“黑箱”。 不幸的是,法律尚未要求其他行业所要求的那种独立审计——例如,针对航空事故和严重化学品泄漏,分别有国家运输安全委员会和化学品安全委员会负责。 州立法者才刚刚开始要求前沿AI公司报告某些严重安全事件,并在某些情况下接受独立审计。但加利福尼亚、纽约和伊利诺伊州的三部主要前沿AI安全法,均未明确强制要求对此类事件启动相当于独立事故调查的机制。 “目前,我们法律体系中的大多数法律只要求对此类事件进行通俗易懂的摘要报告,并未授权政府追问后续问题、派遣调查人员、查阅记录或要求保留这些记录,”LawAI美国法律与政策董事总经理Mackenzie Arnold在周三的媒体简报会上表示。“而这些恰恰是真正弄清事件所需的手段。” 立法者已开始质疑OpenAI应对措施的范围和透明度。本周,众议员Josh Gottheimer(新泽西州民主党)和Mike Lawler(纽约州共和党)提出了一项旨在控制“失控AI智能体”的法案。众议员Greg Casar(得克萨斯州民主党)本周致信OpenAI,称其对Hugging Face入侵事件的调查范围“有限”深感担忧。
分享这篇文章: