随着人工智能模型的不断强大,其被滥用的风险也随之增加,业界对安全防护措施的呼声日益高涨。AI公司如今必须在尊重企业客户隐私和监控使用情况以防止滥用之间,走一条极为微妙的平衡之路。

OpenAI敏锐地抓住机会,推出了一项以隐私为核心的安全监控新方案,旨在超越竞争对手Anthropic。该公司向部分客户预览了一项名为“私密安全处理”(Private Safety Processing)的新服务。这是一套自动化系统,能够监测潜在滥用行为,同时不保留任何客户数据。

这一系统显然与Anthropic最近公布的数据保留政策背道而驰。Anthropic的政策允许其保留用户数据(包括所有会话及对话内容)长达30天,适用于其“覆盖模型”,如Mythos系列及未来具备类似能力的模型。该政策于今年7月发布,旨在提升安全性,便于分析潜在违规行为,但却引发了部分处理大量敏感数据的企业客户的担忧,他们不希望自己的数据被AI实验室存储或审查。

OpenAI和多数AI公司一样,已通过执行“零数据保留”政策(Zero Data Retention,ZDR)为客户提供相对隐私保护。ZDR通过OpenAI API内置的代理,按会话监控滥用行为,确保公司不保留客户数据,同时无需人工干预即可检测异常。值得一提的是,Anthropic在大多数情况下也遵守ZDR,但对“覆盖模型”如Fable例外。

OpenAI表示,私密安全处理技术是对ZDR的扩展,属于一种长周期安全监控,能够评估多次对话的输入和输出,而非仅限于单次会话。该监控由代理自动执行,一旦触发,会跨会话捕捉并分析交互内容,寻找潜在滥用迹象。

OpenAI发言人向TechCrunch透露,这项新技术有助于检测跨多次会话的恶意AI使用行为。例如,恶意用户可能通过分散请求来规避检测,私密安全处理则能在不涉及人工审查用户对话的情况下,分析多次对话中的滥用信号。

当系统触发时,可能向OpenAI发送“明确定义的信号”,警示特定类型的异常活动。基于此信号,OpenAI将决定是否需要采取执法行动。若需要,公司会联系客户获取更多信息或协助解决问题,客户可自行决定是否与OpenAI共享数据。

相比之下,Anthropic允许通过“受控访问路径”进行人工审查,且仅限于少数获批审查员。每次审查均有不可篡改的日志记录,审查员无法删除或修改。

目前,OpenAI与Anthropic之间的竞争异常激烈,双方均在寻找机会取得领先。近期报道显示,OpenAI第二季度增长速度逊于Anthropic。Anthropic的年化收入已达650亿美元,投资者预计其市值IPO可能达到2万亿美元,而OpenAI也在积极筹备上市。