🤖
🤖
核心导读
OpenAI推出名为“私有安全处理”的新服务,以隐私保护为卖点监控AI滥用行为,不保留客户数据。此举直接针对Anthropic引发争议的30天数据保留政策,旨在争夺企业客户。两家AI巨头竞争日趋白热化,OpenAI试图通过差异化的安全策略扳回一局。
随着AI模型的能力越来越强,这些模型被滥用的可能性也随之增加——要求建立安全护栏以阻止此类滥用发生的呼声也日益高涨。如今,AI公司必须在尊重企业客户隐私与监控使用情况以防潜在问题之间走一条微妙的钢丝。
OpenAI察觉到了在与竞争对手Anthropic的较量中抢占先机的机会,于近日宣布了一种以隐私为中心的安全监控方法。该公司正在向部分客户预览一项名为“私有安全处理”(Private Safety Processing)的新服务。这一自动化系统在监控潜在滥用行为的同时,不会保留客户的任何数据。
该系统显然与Anthropic最近宣布的数据保留政策背道而驰。该政策令一些客户感到不满,它允许这家AI实验室在涉及“受覆盖模型”时保留用户数据(包括所有会话及其中对话)长达30天。这些模型包括所有Mythos级模型以及“具有类似能力的未来模型”,该公司表示。
这项政策于7月宣布,其目的是出于安全考虑,允许实验室筛选和分析潜在的不当行为。然而,这引起了许多处理大量敏感数据的企业深切担忧,它们不希望自己的数据被AI实验室保存(或检查)。
OpenAI——与大多数其他AI公司一样——已经通过遵循名为“零数据保留”(Zero Data Retention, ZDR)的政策,为客户提供了一定程度的隐私保护。ZDR使用OpenAI API中的代理按会话监控滥用行为。这样一来,客户数据不会被公司保留,但公司仍然能够在无需人工干预的情况下扫描不良活动。值得注意的是,Anthropic大体上也遵守ZDR——但涉及“受覆盖模型”(如Fable)时除外。
OpenAI表示,“私有安全处理”是一项扩大ZDR范围的新技术。它将其描述为一种长周期安全监控形式,评估多次对话的输入和输出——而不仅仅是一次对话。同样,监控由代理执行,如果被触发,它会捕获交互并在会话之间进行分析,以寻找潜在滥用的迹象。
一位发言人告诉TechCrunch,这项新技术帮助OpenAI检测跨多次会话发生的AI恶意使用。恶意行为者——比如试图设计恶意软件发动网络攻击的人——可能会分散他们的请求以避免被检测。“私有安全处理”可以在无需人工审查用户对话的情况下,分析这些多次对话是否存在滥用迹象。
该公司表示,如果系统被触发,它可能会向OpenAI发送一个“范围明确的信号”,提醒特定类型的活动。基于该信号,OpenAI可以决定是否有必要采取“执法行动”。发言人表示,如果有必要,OpenAI将联系客户以获取更多背景信息或与他们合作处理问题,客户可以自行决定是否与OpenAI共享数据。
相比之下,Anthropic指出,对客户数据的人工审查可能发生,但只能通过“可控的访问路径”,涉及“一小批经批准的审查员”。该公司表示,每一次此类审查会话都会“记录在防篡改日志中,审查员无法抑制或修改”。
目前,OpenAI与Anthropic之间的企业竞争十分激烈,两家公司都在寻找任何机会以获得相对于对方的优势。最近的一份报告显示,OpenAI第二季度的增长速度慢于Anthropic。据报道,Anthropic的年化收入运行率现已达到650亿美元。Anthropic的投资者表示,该公司可能以2万亿美元的估值进行IPO,而OpenAI也在筹备其IPO。
分享这篇文章: